
«عبور از کاربردی به زیبا»؛ هدف جدید مدلهای AI با دادههای ترجیحی
استارتاپ Intelligence با جذب سرمایه برای پلتفرم DesignArena، دادههای ترجیحی انسانی در زمینه زیباییشناسی را برای آزمایشگاههای پیشرو AI فراهم میکند. این شرکت با کمک ۵.۳ میلیون…
موضوع
Models that natively process text+image+audio+video
۸۷۹ مقاله منتشر شده

استارتاپ Intelligence با جذب سرمایه برای پلتفرم DesignArena، دادههای ترجیحی انسانی در زمینه زیباییشناسی را برای آزمایشگاههای پیشرو AI فراهم میکند. این شرکت با کمک ۵.۳ میلیون…

شرکت MiniMax مدل H3 را با وزنهای باز منتشر کرد تا برای نخستین بار یک مدل غیرانحصاری در صدر بنچمارکهای تولید ویدیو قرار گیرد. این مدل ۳۳ میلیارد پارامتری، ویدیوهایی با صدای…

گسترش تعاملات صوتی بلادرنگ با هوش مصنوعی، معماری دفاتر «باز» را به چالش کشیده است. تغییر الگوی کار از تایپ به گفتگو، نیاز به حریم صوتی و فضاهای اختصاصی برای صحبت را به یک ضرورت…

پلتفرم ShadowSocial.io معماری جدیدی برای مدیریت اینفلوئنسرهای هوش مصنوعی معرفی کرد که از طریق بهینهسازی حافظه و قفل کردن چهره، پایداری سیستم را در زمان ترافیک بالا تضمین میکند.…

گوگل به بخشی از کاربران ایالات متحده اجازه داد تا از عکسهای شخصی خود در Google Photos بهعنوان زمینه مستقیم برای تولید تصویر در Gemini استفاده کنند. این تغییر، تمرکز کاربر را از…

شرکت MiniMax مدل H3 را با وزنهای باز منتشر کرد که تولید ویدیوهای 2K همراه با صدای استریو را ممکن میسازد. به دلیل بهینهسازیهای شدید در وزنها، این مدل اکنون روی کارتهای…

یک گردشکار جدید برای مدلهای تبدیل تصویر به ویدیو، از طریق برش دستی عکسها به نسبت ۹:۱۶ پیش از آپلود، مانع از افت کیفیت میشود. با جداسازی ترکیببندی از حرکت در پرامپت، کاربران…

نسخه ۲.۴ ابزار Likeness Lock با تضمین تداوم چهره و لباس در ویدیوهای تولید شده با هوش مصنوعی، نیاز به عکاسیهای مکرر فیزیکی را از بین برد. این سیستم اکنون اجازه میدهد برندهای…

اندریج کارپاتی با استفاده از مدل Claude Opus 5، توصیفات ادبی کتاب «ارباب حلقهها» را به محیطهای گرافیکی سهبعدی در مرورگر تبدیل کرد. این آزمایش نشان میدهد که هوش مصنوعی در حال…

سیستمهای بازشناسی چهره از امنیت سادهی دستگاهها به سمت احراز هویت پیچیده و خردهفروشی شخصیسازیشده حرکت میکنند. مدلهای جدید یادگیری عمیق اکنون قادرند چهرهها را حتی با وجود…

علیبابا مدل عظیم Qwen3.8-Max را با معماری ترکیب خبرهها و پنجره زمینه یک میلیون توکنی منتشر کرد. در حالی که نسخه پرچمدار نیازمند زیرساختهای ابری است، نسخه ۲۷ میلیارد پارامتری با…

پلتفرم Amap متعلق به علیبابا مدلی را معرفی کرد که میتواند محیطهای تعاملی هوش مصنوعی را به مدت ۲۴ ساعت بدون فروپاشی بصری روی یک کارت گرافیک مصرفکننده اجرا کند. این دستاورد با…