
آیا Muse Image قربانی تضاد میان دادههای عمومی و حریم خصوصی شد؟
شرکت متا ابزار تولید تصویر Muse Image را که اجازه میداد کاربران از عکسهای عمومی اینستاگرام برای خلق آثار جدید استفاده کنند، پس از اعتراضات گسترده حذف کرد. این اقدام پس از آن…
موضوع
Models that natively process text+image+audio+video
۱٬۴۲۵ مقاله منتشر شده

شرکت متا ابزار تولید تصویر Muse Image را که اجازه میداد کاربران از عکسهای عمومی اینستاگرام برای خلق آثار جدید استفاده کنند، پس از اعتراضات گسترده حذف کرد. این اقدام پس از آن…

بررسیهای فنی نشان میدهد مدلهای DeepSeek و Qwen عملکردی در سطح GPT-4o دارند اما با کسری از هزینه. این تحول باعث میشود توسعهدهندگان از مدلهای تخصصی برای کدنویسی و استدلال…

تستهای میدانی نشان میدهد مدلهای چینی DeepSeek و Qwen عملکردی در سطح GPT-4o دارند اما با قیمتی بسیار کمتر. توسعهدهندهها با مسیریابی هوشمند وظایف بین مدلهای مختلف، هزینههای…

تیمهای Kyutai و Mirelo مدل وزنباز MuScriptor را برای تبدیل فایلهای صوتی چندسازه به نتهای MIDI معرفی کردند. این مدل با استفاده از یک خطلوله آموزشی سهمرحلهای، رکورد جدیدی را…

هوش مصنوعی چندوجهی با تلفیق دادههای متنوع مانند عکسهای رادیولوژی و متون پزشکی، از پژوهشهای تئوری به کاربردهای عملی منتقل شده است. این رویکرد دقت تشخیص در سلامت و ایمنی ناوبری…

قابلیت جدید Muse Image شرکت متا به کاربران اجازه میدهد با استفاده از محتوای حسابهای عمومی اینستاگرام، آثار هنری و ویدیوهای جدید خلق کنند. کاربران با پروفایل عمومی باید برای…

رفیک آنادول با افتتاح موزه دیتالند در لسآنجلس، هنر هوش مصنوعی را از تولید تصاویر ساده به اکوسیستمهای تعاملی برد. این پروژه با استفاده از یک مدل اختصاصی طبیعت و حسگرهای ضربان…

گوگل مدل بنیادی SensorFM را برای تحلیل دادههای حسگرهای پوشیدنی معرفی کرد که بر روی یک تریلیون دقیقه داده آموزش دیده است. این مدل در ۳۱ مورد از ۳۵ تکلیف بالینی، از جمله تشخیص…

شرکت Ello با جداسازی فرآیند تولید پاسخ از اجرا و استفاده از برنامهریزی ناهمگام، مشکل تأخیر در عاملهای هوش مصنوعی را برای کودکان ۴ تا ۹ سال حل کرد. این رویکرد باعث میشود نرخ…

اوپنایآی با معرفی GPT-Live، معماری صوتی را از حالت نوبتی به دوبلکس کامل تغییر داد. این سیستم با تفکیک لایهٔ تعامل از لایهٔ استدلال، پردازشهای سنگین را به مدل GPT-5.5 میسپرد تا…

استارتآپ فرانسوی Gradium با حمایت انویدیا، ۱۰۰ میلیون دلار جذب کرد تا تأخیرهای آزاردهنده در پاسخهای صوتی هوش مصنوعی را از بین ببرد. این شرکت روی مدلهای صوتی با تأخیر بسیار…

شرکت 1X ربات Neo را با دستهایی دارای ۲۵ درجه آزادی معرفی کرد که تقلیدی دقیق از تاندونهای انسانی است. این ربات با هدف اتوماسیون خانگی طراحی شده، اما فعلاً برای کارهای پیچیده به…