پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۸۷۶ مقاله منتشر شده

کاربردهای مدل‌های زبانی بزرگ در صنعت انرژی
آموزش کاربردی

Oxlo.ai: نرخ ثابت درخواست جایگزین توکن برای تحلیل داده‌های انرژی شد

پلتفرم Oxlo.ai با جایگزینی مدل پرداخت توکنی با نرخ ثابت به‌ازای هر درخواست، هزینه‌های پردازش داده‌های عظیم در صنعت انرژی را به‌شدت کاهش داد. این تغییر مسیر، تحلیل مجموعه‌داده‌های…

۵ دقیقه خواندن
کیت متروکه کریکت مرا به چالش کشید؛ پس برایش صدایی ساختم
آموزش کاربردی

ترکیب Gemini و Solana برای بازگرداندن خاطرات فراموش‌شده در اپلیکیشن Ember

توسعه‌دهنده‌ای به نام هیمانشو اپلیکیشن Ember را طراحی کرده است تا کاربران با سرابی از سرگرمی‌های رهاشده در کودکی مواجه شوند. این ابزار با استفاده از هوش مصنوعی زاینده و بلاک‌چین،…

۳ دقیقه خواندن
تست دو هفته‌ای مدل‌های هوش مصنوعی چینی: نتایج شگفت‌انگیز
آموزش کاربردی

«تغییر پارادایم در هزینه API»؛ رقابت مدل‌های چینی برای جذب توسعه‌دهندگان

بررسی‌های فنی نشان می‌دهد مدل‌های DeepSeek و Qwen عملکردی در سطح GPT-4o دارند اما با کسری از هزینه. این تحول باعث می‌شود توسعه‌دهندگان از مدل‌های تخصصی برای کدنویسی و استدلال…

۷ دقیقه خواندن
موشنسکریپتور: مدل ترنسفورمر متن‌باز برای تبدیل موسیقی چندسازه به MIDI توسط کیوتای منتشر شد.
آموزش کاربردی

MuScriptor: ثبت نت‌ها با دقت ۴۸.۲ در بنچمارک Multi F1 برای موسیقی چند‌سازه

تیم‌های Kyutai و Mirelo مدل وزن‌باز MuScriptor را برای تبدیل فایل‌های صوتی چند‌سازه به نت‌های MIDI معرفی کردند. این مدل با استفاده از یک خط‌لوله آموزشی سه‌مرحله‌ای، رکورد جدیدی را…

۴ دقیقه خواندن
هوش مصنوعی چندوجهی: تحولی بزرگ برای توسعه‌دهندگان
آموزش کاربردی

ترکیب داده‌های متنی و بصری؛ راهکار جدید برای تشخیص دقیق‌تر بیماری‌ها

هوش مصنوعی چندوجهی با تلفیق داده‌های متنوع مانند عکس‌های رادیولوژی و متون پزشکی، از پژوهش‌های تئوری به کاربردهای عملی منتقل شده است. این رویکرد دقت تشخیص در سلامت و ایمنی ناوبری…

۲ دقیقه خواندن
گالری تجربی جدیدی که ممکن است نظرتان را درباره هنر هوش مصنوعی تغییر دهد
سرگرمی و خلاقیت

«از تصویر به اکوسیستم»؛ رویکرد جدید رفیک آنادول در موزه‌ی AI

رفیک آنادول با افتتاح موزه دیتالند در لس‌آنجلس، هنر هوش مصنوعی را از تولید تصاویر ساده به اکوسیستم‌های تعاملی برد. این پروژه با استفاده از یک مدل اختصاصی طبیعت و حسگرهای ضربان…

۷ دقیقه خواندن
مدل پایه سلامت پوشیدنی SensorFM گوگل با پیش‌آموزش روی یک تریلیون دقیقه داده سنسوری

گوگل با مدل SensorFM یک تریلیون دقیقه دادهٔ سلامت پوشیدنی را تحلیل کرد

گوگل مدل بنیادی SensorFM را برای تحلیل داده‌های حسگرهای پوشیدنی معرفی کرد که بر روی یک تریلیون دقیقه داده آموزش دیده است. این مدل در ۳۱ مورد از ۳۵ تکلیف بالینی، از جمله تشخیص…

۶ دقیقه خواندن
معماری یک معلم خصوصی واقعی‌زمان: آموزش کودک در کمتر از ۱۰۰۰ میلی‌ثانیه
آموزش کاربردی

معماری جدید Ello تأخیر پاسخ‌دهی هوش مصنوعی در آموزش کودکان را به زیر یک ثانیه

شرکت Ello با جداسازی فرآیند تولید پاسخ از اجرا و استفاده از برنامه‌ریزی ناهمگام، مشکل تأخیر در عامل‌های هوش مصنوعی را برای کودکان ۴ تا ۹ سال حل کرد. این رویکرد باعث می‌شود نرخ…

۹ دقیقه خواندن