پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۱٬۳۵۶ مقاله منتشر شده

ویدیوهای توضیح‌دهنده هوش مصنوعی: تصویری از ربات آبی در حال ارائه‌ی محتوای آموزشی بر روی صفحه‌ی نمایش.
آموزش کاربردی

گزارش بازاریابی: جایگزینی ویدیوهای سنتی با AI هزینه‌های SMEs را کاهش داد

کسب‌وکارهای کوچک برای کاهش هزینه‌های جاری و تسریع چرخه‌های بازاریابی، تولید ویدیوهای سنتی را با ابزارهای هوش مصنوعی جایگزین می‌کنند. این فناوری امکان بومی‌سازی سریع و بهینه‌سازی…

۶ دقیقه خواندن
نوار ابزار ویندوز با دکمه‌های میکروفون و کیبورد، نشان‌دهنده فعال‌سازی صوتی Codex
آموزش کاربردی

پایداری زیرساخت در برابر منطق تجزیه برای ارتقای مقیاس آموزش AI

مقیاس‌پذیری آموزش مدل‌های چندوجهی بیش از آنکه به منطق تجزیه داده‌ها وابسته باشد، به پایداری زیرساخت جمع‌آوری وابسته است. جداسازی حجم داده‌ها بر اساس حساسیت جغرافیایی، مانع از…

۲ دقیقه خواندن۱
سیستم چندوجهی احساسات هوش مصنوعی مغز ابری Xinxu: معماری یکپارچه پردازش احساسات مبتنی بر ابر
آموزش کاربردی

مدل‌های Xinxu Cloud Brain تشخیص احساسات را به جای تشخیص، فرضیه می‌کنند

سامانه جدید Xinxu Cloud Brain با جایگزینی طبقه‌بندی‌های قطعی با «تلفیق شواهد»، نرخ عدم‌قطعیت را در تشخیص احساسات مدل‌سازی می‌کند. این معماری به جای یک ورودی واحد، متن، گفتار و…

۶ دقیقه خواندن۲
رباتی که می‌تواند در لحظه یاد بگیرد: آینده هوش مصنوعی را دیدم

درون استراتژی Generalist AI برای حذف برنامه‌نویسی دستی در ربات‌ها

استارتاپ Generalist AI در حال توسعه مدل‌هایی است که ربات‌ها را قادر می‌سازد تنها با تماشای ویدیوهای کوتاه، کارهای فیزیکی جدید را بدون آموزش تخصصی یاد بگیرند. این رویکرد با تمرکز…

۴ دقیقه خواندن۱
ربات‌تاکسی‌های اوهای ویمو به دستیار هوش مصنوعی جمینی مجهز شدند

گوگل: جداسازی لایه رانندگی از Gemini ضامن ایمنی ربوتاکسی‌های Waymo است

شرکت Waymo مدل Gemini گوگل را به‌عنوان دستیار صوتی در تاکسی‌های Ojai ادغام کرد تا کنترل کابین و پاسخ به پرسش‌ها را مدیریت کند. این سیستم به‌طور کامل از لایه‌ی رانندگی خودکار جدا…

۴ دقیقه خواندن۱