
Reelful: اتوماسیون تولید ویدیوهای کوتاه با عاملهای هوش مصنوعی
اپلیکیشن Reelful با استفاده از عاملهای هوشمند، تبدیل عکسها و کلیپهای گالری به ویدیوهای حرفهای برای شبکههای اجتماعی را خودکار میکند. این ابزار با هدف کاهش زمان تدوین برای…
موضوع
Models that natively process text+image+audio+video
۱٬۴۲۵ مقاله منتشر شده

اپلیکیشن Reelful با استفاده از عاملهای هوشمند، تبدیل عکسها و کلیپهای گالری به ویدیوهای حرفهای برای شبکههای اجتماعی را خودکار میکند. این ابزار با هدف کاهش زمان تدوین برای…

پلتفرم Hume با معرفی محک Real World VoiceEQ نشان داد که مدلهای صوتی علیرغم نمرات بالای فنی، در درک احساسات و بافتهای صوتی شکست میخورند. دادهها حاکی از آن است که هیچ مدل واحدی…

مدلهای صوتی OpenAI در نمایش «حق تقدمِ گفتگو» مشکل دارند و کاربر نمیداند چه کسی سخن میگوید یا گوش میدهد. برای حل این چالش، یک مدل رابط کاربری مبتنی بر «ماشین حالت» پیشنهاد شده…

متا تنظیماتی را معرفی کرد که به برخی کاربران اجازه میدهد از بهکارگیری محتوای عمومیشان برای آموزش هوش مصنوعی Muse Image جلوگیری کنند. در این سیستم، مدل میتواند بدون اطلاع…

اپل اولین بتای عمومی iOS 27 را با نسخه بازطراحیشدهی Siri AI منتشر کرد. این بهروزرسانی با تمرکز بر آگاهی از محتوای صفحه و جستوجوی پیشرفتهی فایلها، نرخ خطاهای عملیاتی را…

استفاده از مدلهای بینایی-زبانی امکان شناسایی الگوهای پیچیده mixers را بهجای تحلیل دادههای خام، از طریق تحلیل بصری گرافهای تراکنش فراهم میکند. با تنظیم دقیق Qwen2-VL روی…

شرکت PrismML مدل Bonsai 27B را معرفی کرد؛ نخستین مدل در این مقیاس که بهدلیل استفاده از وزنهای ۱-بیتی و ترنری، روی گوشیهای هوشمند اجرا میشود. این مدل قابلیتهای استدلالی…

گوگل در صورت نبود نتایج واقعی، تصاویر را با هوش مصنوعی تولید میکند و صفحه اصلی Google Images را به گالری شخصیسازی شده تبدیل کرده است. این تغییرات نشاندهنده چرخش گوگل از یک…

گوگل قابلیت تولید تصویر با هوش مصنوعی را مستقیماً در بخش AI Overviews قرار داد. کاربران اکنون میتوانند بدون خروج از نتایج جستوجو، با مدل Nano Banana تصاویر سفارشی بسازند.

اسپاتیفای دستیار جدیدی معرفی کرده که به کاربران اجازه میدهد از طریق گفتگوهای صوتی یا متنی، موسیقی خود را مدیریت کنند و تاریخچه شنیداریشان را تحلیل نمایند. این قابلیت در حال حاضر…

کمپانی OpenAI سری مدلهای GPT-5.6 را با قابلیت Computer Use برای کنترل مستقیم رابط کاربری و سه سطح مختلف تفکر روانه بازار کرد. این بهروزرسانی شامل ادغام اپلیکیشنهای macOS و…

اسپاتیفای قابلیت Talk to Spotify را برای کاربران پرمیوم در آمریکا، ایرلند و سوئد عرضه کرد. این ابزار اجازه میدهد کاربران از طریق صوت یا متن، فهرستها را مدیریت کرده و درباره…