
درون استراتژی ۵.۳ میلیارد دلاری Runway برای شبیهسازی واقعیت
شرکت Runway از تولید ابزارهای ویدیوئی به سمت «مدلهای جهانی» حرکت میکند تا قوانین فیزیک را از طریق مشاهده یاد بگیرد. هدف این شرکت ساخت دوقلوی دیجیتالی جهان برای سرعت بخشیدن به…
دستهبندی
تولید تصویر و ویدیو، صدای مصنوعی، هنر و موسیقی هوشمند، بازیها و وجه سرگرمکنندهی AI.
۶۸۷ مقاله منتشر شده

شرکت Runway از تولید ابزارهای ویدیوئی به سمت «مدلهای جهانی» حرکت میکند تا قوانین فیزیک را از طریق مشاهده یاد بگیرد. هدف این شرکت ساخت دوقلوی دیجیتالی جهان برای سرعت بخشیدن به…

نتفلیکس استودیوی داخلی INKubator را برای تولید انیمیشنهای کوتاه با استفاده از هوش مصنوعی زاینده راهاندازی کرد. هدف این واحد، عبور از ابزارهای پستولید و ایجاد یک خط تولید کاملاً…

استارتاپ Origin Lab با جذب ۸ میلیون دلار سرمایه، بازاری را برای فروش دادههای شبیهسازیشدهی بازیهای ویدئویی به آزمایشگاههای هوش مصنوعی ایجاد میکند. این دادهها برای آموزش…

شرکت Luma رابط برنامهنویسی (API) مدل Uni-1.1 را منتشر کرد تا با کیفیت و قیمت OpenAI رقابت کند. این مدل امکان تولید تصاویر با رزولوشن بالا و ویرایش پیشرفته را برای توسعهدهندگان…

چارچوب PoDAR با جداسازی توان سیگنال از محتوای معنایی در فضاهای نهان صوتی، سرعت همگرایی مدلهای زاینده را دو برابر میکند. این رویکرد در مدل F5-TTS منجر به بهبود چشمگیر شباهت…

ضرر سنگین شرکت Arup نشان داد که تکیه به تشخیص انسانی برای شناسایی جعل عمیق دیگر پاسخگو نیست. اکنون صنعت به سمت تحلیلهای الگوریتمی حرکت میکند تا استانداردهای قانونی «دقت معقول»…

یک طراح حرفهای فرمولی ۷ بخشی را معرفی کرده است که تصاویر Midjourney را از حالت مصنوعی خارج کرده و به استانداردهای تجاری میرساند. این روش با تکیه بر ارجاعات سختافزاری و…

پژوهشگران مدل HapticLDM را معرفی کردند؛ نخستین سیستم تبدیل متن به لرزش بر پایه مدلهای انتشار لایهای. این مدل با غلبه بر محدودیتهای مدلهای توالیمحور، بازخوردهای لمسی…

ستارههای هالیوود و آژانسهای مدلینگ از استانداردی فنی برای کنترل برنامهریزیشدهی دسترسی هوش مصنوعی به چهره و صدای خود حمایت میکنند. این سیستم از طریق یک دفتر ثبت مرکزی و…

شرکت Unitree با معرفی ربات GD01، وارد بازار رباتهای سوارشدنی و تغییرپذیر شده است. این ماشین با قیمت ۵۳۷ هزار دلار، بازارهای لوکس و صنعتی را هدف قرار داده تا مسیر را برای عرضه…

پژوهشگران با معرفی DRoRAE، روشی برای تجمیع ویژگیهای تمامی لایههای رمزگذار بصری ابداع کردند که کیفیت بازسازی تصاویر را بهطور چشمگیری افزایش میدهد. این مدل با شناسایی یک قانون…

AllocMV چارچوب جدیدی است که تولید ویدیوهای موسیقی را به یک مسئله تخصیص منابع تبدیل میکند تا هزینههای محاسباتی کاهش و ثبات بصری افزایش یابد. این سیستم با استفاده از یک حلکننده…