پرش به محتوای اصلی

دسته‌بندی

سرگرمی و خلاقیت

تولید تصویر و ویدیو، صدای مصنوعی، هنر و موسیقی هوشمند، بازی‌ها و وجه سرگرم‌کننده‌ی AI.

۶۸۷ مقاله منتشر شده

درون استراتژی ۵.۳ میلیارد دلاری Runway برای شبیه‌سازی واقعیت

درون استراتژی ۵.۳ میلیارد دلاری Runway برای شبیه‌سازی واقعیت

شرکت Runway از تولید ابزارهای ویدیوئی به سمت «مدل‌های جهانی» حرکت می‌کند تا قوانین فیزیک را از طریق مشاهده یاد بگیرد. هدف این شرکت ساخت دوقلوی دیجیتالی جهان برای سرعت بخشیدن به…

۲ دقیقه خواندن۱
سازوکار INKubator: نتفلیکس چگونه تولید انیمیشن را با هوش مصنوعی بازتعریف می‌کند؟

سازوکار INKubator: نتفلیکس چگونه تولید انیمیشن را با هوش مصنوعی بازتعریف می‌کند؟

نتفلیکس استودیوی داخلی INKubator را برای تولید انیمیشن‌های کوتاه با استفاده از هوش مصنوعی زاینده راه‌اندازی کرد. هدف این واحد، عبور از ابزارهای پس‌تولید و ایجاد یک خط تولید کاملاً…

۲ دقیقه خواندن۱
۸ میلیون دلار سرمایه برای تبدیل محیط‌های بازی به داده‌های آموزشی مدل‌های جهانی

۸ میلیون دلار سرمایه برای تبدیل محیط‌های بازی به داده‌های آموزشی مدل‌های جهانی

استارتاپ Origin Lab با جذب ۸ میلیون دلار سرمایه، بازاری را برای فروش داده‌های شبیه‌سازی‌شده‌ی بازی‌های ویدئویی به آزمایشگاه‌های هوش مصنوعی ایجاد می‌کند. این داده‌ها برای آموزش…

۲ دقیقه خواندن
چگونه PoDAR با جداسازی توان سیگنال، سرعت همگرایی مدل‌های صوتی را دو برابر کرد؟

چگونه PoDAR با جداسازی توان سیگنال، سرعت همگرایی مدل‌های صوتی را دو برابر کرد؟

چارچوب PoDAR با جداسازی توان سیگنال از محتوای معنایی در فضاهای نهان صوتی، سرعت همگرایی مدل‌های زاینده را دو برابر می‌کند. این رویکرد در مدل F5-TTS منجر به بهبود چشمگیر شباهت…

۲ دقیقه خواندن۱
چرا تشخیص انسانی جعل عمیق منجر به ضرر ۲۵ میلیون دلاری Arup شد؟
آموزش کاربردی

چرا تشخیص انسانی جعل عمیق منجر به ضرر ۲۵ میلیون دلاری Arup شد؟

ضرر سنگین شرکت Arup نشان داد که تکیه به تشخیص انسانی برای شناسایی جعل عمیق دیگر پاسخگو نیست. اکنون صنعت به سمت تحلیل‌های الگوریتمی حرکت می‌کند تا استانداردهای قانونی «دقت معقول»…

۲ دقیقه خواندن۱
HapticLDM: جایگزینی توالی‌های خطی با مدل‌های انتشار برای تولید لرزش‌های لمسی

HapticLDM: جایگزینی توالی‌های خطی با مدل‌های انتشار برای تولید لرزش‌های لمسی

پژوهشگران مدل HapticLDM را معرفی کردند؛ نخستین سیستم تبدیل متن به لرزش بر پایه مدل‌های انتشار لایه‌ای. این مدل با غلبه بر محدودیت‌های مدل‌های توالی‌محور، بازخوردهای لمسی…

۲ دقیقه خواندن۲
برنامه‌ریزی برای رضایت: تلاش هالیوود برای تبدیل هویت دیجیتال به دارایی تجاری

برنامه‌ریزی برای رضایت: تلاش هالیوود برای تبدیل هویت دیجیتال به دارایی تجاری

ستاره‌های هالیوود و آژانس‌های مدلینگ از استانداردی فنی برای کنترل برنامه‌ریزی‌شده‌ی دسترسی هوش مصنوعی به چهره و صدای خود حمایت می‌کنند. این سیستم از طریق یک دفتر ثبت مرکزی و…

۳ دقیقه خواندن
سازوکار DRoRAE: کاهش rFID در ImageNet از ۰.۵۷ به ۰.۲۹ با تلفیق لایه‌ها

سازوکار DRoRAE: کاهش rFID در ImageNet از ۰.۵۷ به ۰.۲۹ با تلفیق لایه‌ها

پژوهشگران با معرفی DRoRAE، روشی برای تجمیع ویژگی‌های تمامی لایه‌های رمزگذار بصری ابداع کردند که کیفیت بازسازی تصاویر را به‌طور چشم‌گیری افزایش می‌دهد. این مدل با شناسایی یک قانون…

۲ دقیقه خواندن۱
سازوکار AllocMV: مدیریت منابع محاسباتی برای حفظ ثبات بصری در ویدیوهای بلند

سازوکار AllocMV: مدیریت منابع محاسباتی برای حفظ ثبات بصری در ویدیوهای بلند

AllocMV چارچوب جدیدی است که تولید ویدیوهای موسیقی را به یک مسئله تخصیص منابع تبدیل می‌کند تا هزینه‌های محاسباتی کاهش و ثبات بصری افزایش یابد. این سیستم با استفاده از یک حل‌کننده…

۲ دقیقه خواندن