پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۱٬۳۵۸ مقاله منتشر شده

ویدیوی تعاملی لحظه‌ای: پایان رسانه منفعل و ظهور پیکسل‌های قابل‌برنامه‌ریزی
آموزش کاربردی

پلتفرم Reactor تأخیر مدل‌های دنیای مجازی را به زیر ۵۰ میلی‌ثانیه رساند

پلتفرم Reactor با ارائه زیرساختی برای مدل‌های دنیای مجازی، امکان ساخت ویدیوهای تعاملی با تأخیر زیر ۵۰ میلی‌ثانیه را فراهم کرد. این فناوری مرز میان تماشای غیرفعال ویدیو و محیط‌های…

۶ دقیقه خواندن۱
مرکز داده‌ای در مدار زمین: رقابت برای قرار دادن هوش مصنوعی در فضا

قرارداد ۲۶ میلیارد دلاری اسپیس‌اکس برای ساخت مراکز دادهٔ هوش مصنوعی در مدار

اسپیس‌اکس و xAI با ادغام زیرساخت‌های پرتاب و محاسباتی، در حال تبدیل مدار زمین به لایه‌ای از مراکز دادهٔ عظیم هستند. قراردادهای میلیاردی با گوگل و آنتروپیک نشان می‌دهد که استنتاج…

۷ دقیقه خواندن
از ایده تا تصویر نهایی: چگونه عامل‌های تصویر هوش مصنوعی تولید محتوا را متحول می‌کنند
آموزش کاربردی

آیا عامل‌های هوش مصنوعی جایگزین مهارت‌های سختِ پرامپت‌نویسی می‌شوند؟

عامل‌های هوش مصنوعی در حوزه تصویر، جایگزین کنترل‌های سخت‌افزاری و پرامپت‌های پیچیده شده‌اند تا خلق محتوا را به یک همکاری زبانی تبدیل کنند. این ابزارها با قابلیت ویرایش بر اساس…

۲ دقیقه خواندن۱
موزیک v2.5 الون‌لبز با قابلیت‌های رایگان و حرفه‌ای در اپ و API عرضه شد

تست کور ۴۷ هزارتایی: مدل Music v2.5 ایلون‌لبز در طبیعی‌بودن موسیقی پیشتاز شد

شرکت Elevenlabs مدل Music v2.5 را برای تولید موسیقی طبیعی‌تر در سبک‌های راک و R&B عرضه کرد. این به‌روزرسانی با اعمال حفاظ‌های سخت‌گیرانه علیه شبیه‌سازی هنرمندان، تلاش می‌کند از…

۱ دقیقه خواندن
موزیک‌باکس قدیمی با استوانه فلزی و میله‌های ریز، نمادی از موسیقی قابل برنامه‌ریزی.
سرگرمی و خلاقیت

محدودیت‌های انسانی؛ شرط لازم برای تبدیل داده‌های صوتی به موسیقی

موسیقی در حال تبدیل شدن به یک فرآیند برنامه‌ریزی‌پذیر است، اما اعتبار فنی به معنای کیفیت هنری نیست. در این گذار، نقش خالق اثر از اجرای دستی به تعیین چارچوب‌ها و قضاوت‌های سطح بالا…

۶ دقیقه خواندن۱
چرخ داده هیوندای موتور گروپ به طور کامل فعال شد

چرخه داده‌های هیوندای؛ استراتژی تسریع رانندگی خودکار تا سال ۲۰۲۹

گروه موتور هیوندای با معرفی سامانه «چرخه داده» (Data Flywheel)، فرآیند آموزش هوش مصنوعی خودروهای خود را از مدل خطی به حلقوی تغییر داد. این استراتژی با تکیه بر همکاری با انویدیا و…

۶ دقیقه خواندن۱
معرفی نسل سوم مدل‌های بنیادی اپل

اپل با تکنیک هرس دستوری مصرف حافظه AI را در دستگاه‌های کاربر کاهش داد

اپل نسل سوم مدل‌های بنیادی خود را معرفی کرد که با معماری پراکنده، اجرای مدل‌های ۲۰ میلیارد پارامتری را روی سخت‌افزار مصرف‌کننده ممکن می‌کند. این سامانه بار محاسباتی را بین…

۱۲ دقیقه خواندن
سایتی ساختم که هر انتخاب در آن، ویدیویی تولیدشده با هوش مصنوعی است.
آموزش کاربردی

کاهش هزینه تولید ویدیوهای هوش مصنوعی از هزاران دلار به ۳ دلار در PlayCYOA

یک توسعه‌دهنده مستقل با استفاده از سیستم «شاخه‌بندی ناهمگام»، هزینه تولید ویدیوهای تعاملی را به شدت کاهش داد. پلتفرم PlayCYOA به جای تولید لحظه‌ای، از ویدیوهای پیش‌رندر شده برای…

۲ دقیقه خواندن
دستگاه بیومتریک: وزارت امنیت داخلی آمریکا ۴۴۰ میلیون دلار روی دوربین‌ها شرط‌بندی کرد
آموزش کاربردی

آیا سخت‌افزارهای پیشرفته می‌توانند ضعف مدل‌های شناسایی چهره را بپوشانند؟

وزارت امنیت داخلی آمریکا با تخصیص ۴۴۰ میلیون دلار برای سخت‌افزارهای بیومتریک، تأیید کرد که نقص‌های داده در سطح سنسور با نرم‌افزار قابل جبران نیستند. این چرخش راهبردی نشان می‌دهد…

۳ دقیقه خواندن۱