پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۸۷۸ مقاله منتشر شده

دیو گارگ، مدیرعامل و هم‌بنیان‌گذار AGI, Inc در مصاحبه‌ای اختصاصی

AGI Inc با حذف APIها، کنترل گوشی‌های هوشمند را به عامل‌های محلی سپرد

شرکت AGI Inc در حال توسعه سامانه AGI-0 است که به‌جای تکیه بر APIها، مستقیماً با رابط کاربری نمایشگر تعامل می‌کند. این شرکت برای کاهش تأخیر و افزایش حریم خصوصی، با کوالکام و لنوو…

۸ دقیقه خواندن۲
عوامل هوش مصنوعی ترجیح می‌دهند آثار دارای حق نشر را بدزدند تا از گزینه‌های متن‌باز استفاده کنند

Copyright-Bench: تمایل عامل‌های AI به سرقت تصاویر با وجود جایگزین‌های رایگان

پژوهش جدید نشان می‌دهد عامل‌های هوش مصنوعی، چه تجاری و چه متن‌باز، تمایل دارند تصاویر دارای کپی‌رایت را به جای جایگزین‌های رایگان و باکیفیت انتخاب کنند. این مطالعه تأکید می‌کند که…

۱۰ دقیقه خواندن۲
تولیدکننده انفرادی ویدیو که از هوش مصنوعی برای ساخت تبلیغات خلاقانه استفاده می‌کند.
زندگی با AI

تولیدکنندگان مستقل با ابزارهای تبلیغاتی AI چرخه‌ی تولید ویدیو را کوتاه کردند

یک تولیدکننده محتوا فاش کرد که چگونه ابزارهای تولید تبلیغات با هوش مصنوعی، جریان کار را از ویرایش دستی خسته‌کننده به تست‌های سریع و تکرارشونده تغییر داده است. در این رویکرد، AI…

۶ دقیقه خواندن
گزارش: آمازون مدل‌های هوش مصنوعی نوا را کاهش می‌دهد و روی تیم تحقیقاتی مرزی جدید شرط‌بندی می‌کند
اخبار کوتاه روزانهگزارش تأییدنشده

درون تغییر استراتژی آمازون؛ جایگزینی مدل‌های Nova با پژوهش‌های مرزی

آمازون با تغییر استراتژی، توسعه اکثر مدل‌های خانواده Nova را متوقف کرد تا منابع خود را به تیم پژوهش‌های پیشرو (Frontier Model Research) منتقل کند. هدف این شرکت معرفی یک مدل بنیادی…

۱ دقیقه خواندن۱
پلتفرم OlmoEarth: استنتاج مکانی در مقیاس سیاره‌ای
آموزش کاربردی

درون OlmoEarth؛ سازوکار تحلیل سریع داده‌های حجیم ماهواره‌ای

مؤسسه AI2 با معرفی پلتفرم OlmoEarth، گلوگاه‌های پردازشی داده‌های ماهواره‌ای را حذف کرد. این سامانه اکنون می‌تواند ده‌ها ترابایت تصویر ماهواره‌ای را با هزینه‌ای بسیار اندک و سرعتی…

۸ دقیقه خواندن
نحوه مدل‌سازی ادعاهای علمی قبل از تولید نمودار
آموزش کاربردی

جایگزینی مشخصات فنی با پیکسل‌ها؛ راهکار جدید حذف توهم در دیاگرام‌های علمی

یک گردش‌کار جدید در تصویرسازی علمی، مدل‌های هوش مصنوعی را از تولید مستقیم تصویر به مدل «ابتدا مشخصات» منتقل کرده است. این سیستم با اجبار مدل به تعریف توپولوژی و شواهد پیش از…

۵ دقیقه خواندن۱
لوگوی Fish Audio و عنوان مقاله: جذب ۵۰ میلیون دلار سرمایه اولیه برای ساخت مدل‌های صدای هوش مصنوعی

Fish Audio با ۵۰ میلیون دلار سرمایه کنترل دقیق احساسات را به صداهای مصنوعی آورد

استارت‌آپ Fish Audio برای خروج از عصر صداهای رباتیک، ۵۰ میلیون دلار سرمایه جذب کرد. این شرکت با ارائه بیش از ۱۵ هزار کنترل دقیق روی لحن و احساس، امکان تولید صداهای انسانی و قابل…

۴ دقیقه خواندن۴