پرش به محتوای اصلی

دسته‌بندی

سرگرمی و خلاقیت

تولید تصویر و ویدیو، صدای مصنوعی، هنر و موسیقی هوشمند، بازی‌ها و وجه سرگرم‌کننده‌ی AI.

۶۸۷ مقاله منتشر شده

چرا اشتراک‌های ابری ویدئویی شما تا اواخر ۲۰۲۵ بی‌فایده می‌شوند

چرا اشتراک‌های ابری ویدئویی شما تا اواخر ۲۰۲۵ بی‌فایده می‌شوند

تولید ویدئو با هوش مصنوعی از ابر به دسکتاپ نقل مکان کرده است. مدل‌های جدیدی مانند HunyuanVideo کیفیت تجاری را روی سخت‌افزارهای مصرف‌کننده ممکن کرده‌اند و نیاز به اشتراک‌های…

۲ دقیقه خواندن
راز ۷.۵ هرتز: مایکروسافت چگونه صدای انسان را برای یک ساعت تثبیت کرد؟
آموزش کاربردی

راز ۷.۵ هرتز: مایکروسافت چگونه صدای انسان را برای یک ساعت تثبیت کرد؟

مایکروسافت با معرفی VibeVoice، عصر خرد کردن فایل‌های صوتی را به پایان رساند. این چارچوب قادر است فایل‌های ۶۰ دقیقه‌ای را در یک مرحله پردازش کند و انسجام لحن گوینده را در بازه‌های…

۲ دقیقه خواندن۱
تزریق ویژگی‌های لایه‌ای: رمز پیروزی MOSS-Audio بر مدل‌های حجیم

تزریق ویژگی‌های لایه‌ای: رمز پیروزی MOSS-Audio بر مدل‌های حجیم

پلتفرم OpenMOSS با معرفی MOSS-Audio، مرزهای تحلیل صوتی را جابه‌جا کرد. این مدل بنیادی با معماری نوآورانه، توانسته است در نسخه‌ی ۸ میلیاردی خود، مدل‌های ۳۰ میلیاردی را در دقت تحلیل…

۳ دقیقه خواندن
پایان عصر مدل‌های همه‌کاره: نقشه جدید برای جریان‌های کاری خلاق

پایان عصر مدل‌های همه‌کاره: نقشه جدید برای جریان‌های کاری خلاق

پژوهش جدید Contra Labs نشان می‌دهد که هیچ مدل هوش مصنوعی زاینده‌ای در تمام مراحل خلق اثر برنده نیست. این مطالعه تفاوت میان «سلیقه» و «استانداردهای حرفه‌ای» را رمزگشایی کرده و…

۳ دقیقه خواندن
QYOLO: جادوی میکسینگ کوانتومی برای حذف ۲۰ درصدی پارامترهای YOLOv8

QYOLO: جادوی میکسینگ کوانتومی برای حذف ۲۰ درصدی پارامترهای YOLOv8

پژوهشگران با معرفی چارچوب QYOLO توانستند حجم مدل‌های تشخیص شیء را بیش از ۲۰ درصد کاهش دهند. این دستاورد با جایگزینی ماژول‌های سنگین با میکسینگ الهام‌گرفته از کوانتوم به دست آمده و…

۳ دقیقه خواندن۱
CheXthought: ۶ میلیون نقطه توجه بصری برای پایان دادن به توهمات پزشکی

CheXthought: ۶ میلیون نقطه توجه بصری برای پایان دادن به توهمات پزشکی

پژوهشگران مجموعه‌داده عظیم و چندوجهی CheXthought را معرفی کردند که مسیر تفکر و نقاط تمرکز رادیولوژیست‌ها را ثبت کرده است. این ابزار با آموزش مدل‌ها برای «دیدن» مانند انسان، توهمات…

۲ دقیقه خواندن
ترفندی در استنتاج که مدل‌های بینایی ماشین را تیزبین‌تر می‌کند

ترفندی در استنتاج که مدل‌های بینایی ماشین را تیزبین‌تر می‌کند

ViCrop-Det یک چارچوب استنتاج بدون نیاز به آموزش است که با استفاده از آنتروپی توجه، دقت تشخیص اشیاء کوچک را به‌طور چشم‌گیری افزایش می‌دهد. این متد بدون تغییر در وزن‌های مدل، mAP را…

۲ دقیقه خواندن
پایان رویای جایگزینی: حقیقت تلخ داده‌های مصنوعی در صنعت

پایان رویای جایگزینی: حقیقت تلخ داده‌های مصنوعی در صنعت

پژوهش جدید SynSur ثابت کرد که داده‌های مصنوعی به تنهایی نمی‌توانند جایگزین نمونه‌های واقعی صنعتی شوند. با این حال، ترکیب این دو منبع، دقت تشخیص عیوب را در محیط‌های کم‌داده به‌طور…

۲ دقیقه خواندن۱