پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۱٬۴۲۵ مقاله منتشر شده

سیستم چندوجهی احساسات هوش مصنوعی مغز ابری Xinxu: معماری یکپارچه پردازش احساسات مبتنی بر ابر
آموزش کاربردی

مدل‌های Xinxu Cloud Brain تشخیص احساسات را به جای تشخیص، فرضیه می‌کنند

سامانه جدید Xinxu Cloud Brain با جایگزینی طبقه‌بندی‌های قطعی با «تلفیق شواهد»، نرخ عدم‌قطعیت را در تشخیص احساسات مدل‌سازی می‌کند. این معماری به جای یک ورودی واحد، متن، گفتار و…

۶ دقیقه خواندن۳
رباتی که می‌تواند در لحظه یاد بگیرد: آینده هوش مصنوعی را دیدم

درون استراتژی Generalist AI برای حذف برنامه‌نویسی دستی در ربات‌ها

استارتاپ Generalist AI در حال توسعه مدل‌هایی است که ربات‌ها را قادر می‌سازد تنها با تماشای ویدیوهای کوتاه، کارهای فیزیکی جدید را بدون آموزش تخصصی یاد بگیرند. این رویکرد با تمرکز…

۴ دقیقه خواندن۲
ربات‌تاکسی‌های اوهای ویمو به دستیار هوش مصنوعی جمینی مجهز شدند

گوگل: جداسازی لایه رانندگی از Gemini ضامن ایمنی ربوتاکسی‌های Waymo است

شرکت Waymo مدل Gemini گوگل را به‌عنوان دستیار صوتی در تاکسی‌های Ojai ادغام کرد تا کنترل کابین و پاسخ به پرسش‌ها را مدیریت کند. این سیستم به‌طور کامل از لایه‌ی رانندگی خودکار جدا…

۴ دقیقه خواندن۱
داستان‌سرایی تعاملی با هوش مصنوعی: تجربه‌ای با Gemini
آموزش کاربردی

ترکیب Gemini و سخت‌افزار Lunii؛ تبدیل اسباب‌بازی‌های صوتی به تئاترهای شخصی AI

یک توسعه‌دهنده با استفاده از مدل‌های تبدیل متن به گفتار و تصویر گوگل، یک سیستم تولید داستان شخصی‌سازی‌شده برای دستگاه Lunii ساخت. این پروژه محتوای تولیدی هوش مصنوعی را مستقیماً به…

۴ دقیقه خواندن۲