
«از تصویر به اکوسیستم»؛ رویکرد جدید رفیک آنادول در موزهی AI
رفیک آنادول با افتتاح موزه دیتالند در لسآنجلس، هنر هوش مصنوعی را از تولید تصاویر ساده به اکوسیستمهای تعاملی برد. این پروژه با استفاده از یک مدل اختصاصی طبیعت و حسگرهای ضربان…
موضوع
Models that natively process text+image+audio+video
۱٬۳۴۷ مقاله منتشر شده

رفیک آنادول با افتتاح موزه دیتالند در لسآنجلس، هنر هوش مصنوعی را از تولید تصاویر ساده به اکوسیستمهای تعاملی برد. این پروژه با استفاده از یک مدل اختصاصی طبیعت و حسگرهای ضربان…

گوگل مدل بنیادی SensorFM را برای تحلیل دادههای حسگرهای پوشیدنی معرفی کرد که بر روی یک تریلیون دقیقه داده آموزش دیده است. این مدل در ۳۱ مورد از ۳۵ تکلیف بالینی، از جمله تشخیص…

شرکت Ello با جداسازی فرآیند تولید پاسخ از اجرا و استفاده از برنامهریزی ناهمگام، مشکل تأخیر در عاملهای هوش مصنوعی را برای کودکان ۴ تا ۹ سال حل کرد. این رویکرد باعث میشود نرخ…

اوپنایآی با معرفی GPT-Live، معماری صوتی را از حالت نوبتی به دوبلکس کامل تغییر داد. این سیستم با تفکیک لایهٔ تعامل از لایهٔ استدلال، پردازشهای سنگین را به مدل GPT-5.5 میسپرد تا…

استارتآپ فرانسوی Gradium با حمایت انویدیا، ۱۰۰ میلیون دلار جذب کرد تا تأخیرهای آزاردهنده در پاسخهای صوتی هوش مصنوعی را از بین ببرد. این شرکت روی مدلهای صوتی با تأخیر بسیار…

شرکت 1X ربات Neo را با دستهایی دارای ۲۵ درجه آزادی معرفی کرد که تقلیدی دقیق از تاندونهای انسانی است. این ربات با هدف اتوماسیون خانگی طراحی شده، اما فعلاً برای کارهای پیچیده به…

شرکت Image Line ابزار Gopher AI را از یک راهنمای متنی به دستیاری فعال تبدیل کرد که میتواند آهنگسازی و اعمال افکتها را در DAW انجام دهد. این بهروزرسانی شامل بازبینی موتور Flex و…

افزار FableCut با تبدیل کل خط زمانی تدوین را به یک سند JSON، امکان کنترل دقیق و لحظهای ویدیوها را به عاملهای هوشمند میدهد. این سیستم برخلاف مدلهای مولد، اجازه میدهد انسان و…

پلتفرم Character.ai با ورود به بازار میکرودراما، سریالهایی تولید کرده که کاربران میتوانند با شخصیتهای آن گفتگو کنند و مسیر داستان را تغییر دهند. این شرکت قصد دارد از یک مدل…
ابزارهای ساخت آواتار بر اساس سه معماری رندرینگ متفاوت عمل میکنند که مستقیماً بر سرعت، پایداری و مدل قیمتگذاری آنها اثر میگذارد. انتخاب اشتباه ابزار بدون درک این تفاوتها، منجر…

مدل ۹ میلیارد پارامتری Lift با حذف مرحله تبدیل به Markdown، دادههای ساختاریافته را مستقیماً از تصاویر PDF به JSON تبدیل میکند. این مدل در سرعت استنتاج از Gemini Flash 3.5 جلو…

ابزار متنباز SWT با بهرهگیری از چارچوب FunASR، امکان تبدیل گفتار به متن را بهصورت کاملاً آفلاین فراهم میکند. این نرمافزار با انتقال استنتاج به سختافزار کاربر، ریسک نشت…