پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۱٬۴۲۵ مقاله منتشر شده

تست دو هفته‌ای مدل‌های هوش مصنوعی چینی: نتایج شگفت‌انگیز
آموزش کاربردی

«تغییر پارادایم در هزینه API»؛ رقابت مدل‌های چینی برای جذب توسعه‌دهندگان

بررسی‌های فنی نشان می‌دهد مدل‌های DeepSeek و Qwen عملکردی در سطح GPT-4o دارند اما با کسری از هزینه. این تحول باعث می‌شود توسعه‌دهندگان از مدل‌های تخصصی برای کدنویسی و استدلال…

۷ دقیقه خواندن
موشنسکریپتور: مدل ترنسفورمر متن‌باز برای تبدیل موسیقی چندسازه به MIDI توسط کیوتای منتشر شد.
آموزش کاربردی

MuScriptor: ثبت نت‌ها با دقت ۴۸.۲ در بنچمارک Multi F1 برای موسیقی چند‌سازه

تیم‌های Kyutai و Mirelo مدل وزن‌باز MuScriptor را برای تبدیل فایل‌های صوتی چند‌سازه به نت‌های MIDI معرفی کردند. این مدل با استفاده از یک خط‌لوله آموزشی سه‌مرحله‌ای، رکورد جدیدی را…

۴ دقیقه خواندن۲
هوش مصنوعی چندوجهی: تحولی بزرگ برای توسعه‌دهندگان
آموزش کاربردی

ترکیب داده‌های متنی و بصری؛ راهکار جدید برای تشخیص دقیق‌تر بیماری‌ها

هوش مصنوعی چندوجهی با تلفیق داده‌های متنوع مانند عکس‌های رادیولوژی و متون پزشکی، از پژوهش‌های تئوری به کاربردهای عملی منتقل شده است. این رویکرد دقت تشخیص در سلامت و ایمنی ناوبری…

۲ دقیقه خواندن
گالری تجربی جدیدی که ممکن است نظرتان را درباره هنر هوش مصنوعی تغییر دهد

«از تصویر به اکوسیستم»؛ رویکرد جدید رفیک آنادول در موزه‌ی AI

رفیک آنادول با افتتاح موزه دیتالند در لس‌آنجلس، هنر هوش مصنوعی را از تولید تصاویر ساده به اکوسیستم‌های تعاملی برد. این پروژه با استفاده از یک مدل اختصاصی طبیعت و حسگرهای ضربان…

۷ دقیقه خواندن۲
مدل پایه سلامت پوشیدنی SensorFM گوگل با پیش‌آموزش روی یک تریلیون دقیقه داده سنسوری

گوگل با مدل SensorFM یک تریلیون دقیقه دادهٔ سلامت پوشیدنی را تحلیل کرد

گوگل مدل بنیادی SensorFM را برای تحلیل داده‌های حسگرهای پوشیدنی معرفی کرد که بر روی یک تریلیون دقیقه داده آموزش دیده است. این مدل در ۳۱ مورد از ۳۵ تکلیف بالینی، از جمله تشخیص…

۶ دقیقه خواندن۲
معماری یک معلم خصوصی واقعی‌زمان: آموزش کودک در کمتر از ۱۰۰۰ میلی‌ثانیه
آموزش کاربردی

معماری جدید Ello تأخیر پاسخ‌دهی هوش مصنوعی در آموزش کودکان را به زیر یک ثانیه

شرکت Ello با جداسازی فرآیند تولید پاسخ از اجرا و استفاده از برنامه‌ریزی ناهمگام، مشکل تأخیر در عامل‌های هوش مصنوعی را برای کودکان ۴ تا ۹ سال حل کرد. این رویکرد باعث می‌شود نرخ…

۹ دقیقه خواندن۱
استارتاپ صدای هوش مصنوعی گریدیوم مستقر در پاریس، ۱۰۰ میلیون دلار سرمایه اولیه با حمایت انویدیا جذب کرد.

«حذف تأخیرهای آزاردهنده»؛ هدف Gradium از جذب ۱۰۰ میلیون دلار سرمایه

استارت‌آپ فرانسوی Gradium با حمایت انویدیا، ۱۰۰ میلیون دلار جذب کرد تا تأخیرهای آزاردهنده در پاسخ‌های صوتی هوش مصنوعی را از بین ببرد. این شرکت روی مدل‌های صوتی با تأخیر بسیار…

۲ دقیقه خواندن
ربات Neo شرکت 1X با انگشتانی با سرعت شگفت‌انگیز

ربات Neo با دست‌های پنج‌انگشتی به دقت حرکتی انسان نزدیک شد

شرکت 1X ربات Neo را با دست‌هایی دارای ۲۵ درجه آزادی معرفی کرد که تقلیدی دقیق از تاندون‌های انسانی است. این ربات با هدف اتوماسیون خانگی طراحی شده، اما فعلاً برای کارهای پیچیده به…

۵ دقیقه خواندن۱