از تکدارایی به خط تولید: سازوکار گوگل برای خودکارسازی بصری I/O 2026
گوگل فاش کرد که چگونه با ابزارهای آزمایشی Nano Banana و Gemini Omni، تمام هویت بصری و تجربیات تعاملی I/O 2026 را خودکار کرده است. این رویکرد، کارهای تکراری تولید را حذف میکند تا…
موضوع
Models that natively process text+image+audio+video
۱٬۴۲۰ مقاله منتشر شده
گوگل فاش کرد که چگونه با ابزارهای آزمایشی Nano Banana و Gemini Omni، تمام هویت بصری و تجربیات تعاملی I/O 2026 را خودکار کرده است. این رویکرد، کارهای تکراری تولید را حذف میکند تا…
شرکت بیمه Travelers با استفاده از API Realtime شرکت OpenAI، دستیار صوتی هوشمندی را برای مدیریت پروندههای خسارت در سطح ملی مستقر کرد. این سیستم با نرخ تکمیل ۸۵ تا ۹۰ درصدی، زمان…
مدل M3 از شرکت MiniMax، نخستین مدل بازمتنی است که حافظه یک میلیون توکنی را با قابلیتهای چندوجهی ترکیب میکند. این مدل در بنچمارکهای کدنویسی و جستجوی وب، رقبای قدرتمندی چون…
شرکت StepFun مدل Step 3.7 Flash را معرفی کرد؛ یک مدل ۱۹۸ میلیارد پارامتری بهینه برای پردازندههای NVIDIA. این مدل استدلال چندوجهی در مقیاس سازمانی را با پنجره متنی ۲۵۶ هزار توکنی…
گوگل با رفع چندین باگ فنی، سرعت اتمام سهمیهی کاربران Gemini را کاهش داد. از مهمترین تغییرات میتوان به رایگان شدن درخواستهای Flash Lite و دو برابر شدن سهمیه ویدئو برای کاربران…
فیلم ۷۵ دقیقهای «رویاهای بنفشه» با بودجهای اندک، نخستین اثر بلند ساختهشده با هوش مصنوعی است که به برنامه اصلی جشنواره تریبکا راه یافت. این اتفاق نشان میدهد که کیفیت بصری سینما…
شرکت Sesame با معرفی اپلیکیشنی مبتنی بر جستجوی موازی، سکوتهای طولانی چتباتها را حذف کرد. این سیستم به عاملهای هوش مصنوعی اجازه میدهد پاسخهای خود را در حین صحبت بهروز کنند.
مدل بهروزرسانیشدهی MAI-Image-2.5 مایکروسافت اکنون در رتبهی سوم جدول Arena قرار دارد و با مدل Nano Banana 2 گوگل برابر شده است. این بهروزرسانی بر تصاویر تجاری و رندر متن تمرکز…
گوگل در رویداد I/O ۲۰۲۶ از Google Pics پرده برداشت؛ ابزاری برای طراحی که با قابلیت ویرایش شیءمحور، اجازه میدهد بدون بازسازی کل تصویر، تنها بخشهای خاصی از آن را تغییر دهید.
انویدیا ابزار ACE را برای پشتیبانی از شخصیتهای هوش مصنوعی چندزبانه بهروزرسانی کرد و DLSS 4.5 را برای موتور آنریل منتشر نمود. این تغییرات امکان ایجاد NPCهای گفتگومحور روی دستگاه…
ربات Reachy Mini اکنون میتواند تمام مراحل تبدیل گفتار به گفتار را بهصورت محلی اجرا کند. این تغییر نیاز به سرورهای ابری و کلیدهای API را حذف کرده و حریم خصوصی کامل و هزینه صفر…
یوتیوب سیستم اظهارات داوطلبانه سازندگان را کنار گذاشته و شناسایی خودکار ویدیوهای واقعگرایانه AI را جایگزین میکند. این پلتفرم اکنون با استفاده از سیگنالهای داخلی و متادیتای…