پرش به محتوای اصلی

دسته‌بندی

سرگرمی و خلاقیت

تولید تصویر و ویدیو، صدای مصنوعی، هنر و موسیقی هوشمند، بازی‌ها و وجه سرگرم‌کننده‌ی AI.

۶۸۷ مقاله منتشر شده

ART-VITON: روشی نوین برای پروتز مجازی لباس با استفاده از انتشار نهان هدایت‌شده

ART-VITON: روشی نوین برای پروتز مجازی لباس با استفاده از انتشار نهان هدایت‌شده

محققان ART-VITON را توسعه دادند؛ چارچوبی مبتنی بر انتشار هدایت‌شده با معیارهای اندازه‌گیری که با حفظ هویت افراد و پس‌زمینه، مشکل مصنوعات ناخواسته را در پروتز مجازی لباس برطرف…

۱ دقیقه خواندن
چارچوب DiT-ST مشکل درک کپشن‌های پیچیده در تولید تصویر با هوش مصنوعی را حل کرد

چارچوب DiT-ST مشکل درک کپشن‌های پیچیده در تولید تصویر با هوش مصنوعی را حل کرد

پژوهشگران چارچوبی به نام DiT-ST توسعه داده‌اند که کپشن‌های پیچیده را به واحدهای معنایی سلسله‌مراتبی تجزیه می‌کند. این رویکرد درک مدل‌های منتشر را در تولید تصویر از روی متن بهبود…

۱ دقیقه خواندن
پاداش‌های عقلانی: مقیاس‌بندی تولید بصری با پاداش‌های استدلالی

پاداش‌های عقلانی: مقیاس‌بندی تولید بصری با پاداش‌های استدلالی

چارچوب RationalRewards مدل‌های پاداش چندبُعدی را معرفی می‌کند که در زمان آموزش و آزمایش، کیفیت تولیدکننده‌های تصویر را بهبود می‌بخشند. این مدل به دقت بالا در پیش‌بینی ترجیحات دست…

۱ دقیقه خواندن۲
گوگل لیریا ۳ پرو را با قابلیت تولید موسیقی ۳ دقیقه‌ای عرضه کرد

گوگل لیریا ۳ پرو را با قابلیت تولید موسیقی ۳ دقیقه‌ای عرضه کرد

گوگل مدل پیشرفته تولید موسیقی لیریا ۳ پرو را منتشر کرد که امکان ساخت قطعات تا ۳ دقیقه با درک عمیق‌تر از ساختار موسیقایی را فراهم می‌کند. این مدل در پلتفرم‌های مختلف از جمله Vertex…

۳ دقیقه خواندن
MeloTune رونمایی کرد: یادگیری برانگیختگی روی دستگاه برای انتخاب هوشمند موسیقی

MeloTune رونمایی کرد: یادگیری برانگیختگی روی دستگاه برای انتخاب هوشمند موسیقی

تیمی از پژوهشگران سیستم **MeloTune** را معرفی کرده‌اند؛ عاملی موسیقایی که الگوهای برانگیختگی هر شنونده را شناسایی و پیش‌بینی می‌کند. این سیستم با دو شبکه زمان پیوسته بسته‌ای روی…

۲ دقیقه خواندن۱
تکامل هوشمند توصیه‌ها برای تصویرسازی بهتر با هوش مصنوعی زاینده

تکامل هوشمند توصیه‌ها برای تصویرسازی بهتر با هوش مصنوعی زاینده

پژوهشگران روشی معرفی کرده‌اند که از دسته‌بندهای چندبرچسبی برای هدایت الگوریتم‌های تکاملی در فرآیند تولید تصویر استفاده می‌کند. این رویکرد به‌جای بهبود توصیه‌ها از پیش یا تقویت…

۱ دقیقه خواندن۱
توربو-دی‌دی‌سی‌ام؛ روشی نوین برای فشرده‌سازی تصویر با انتشار

توربو-دی‌دی‌سی‌ام؛ روشی نوین برای فشرده‌سازی تصویر با انتشار

تیمی از پژوهشگران روش **توربو-دی‌دی‌سی‌ام** را معرفی کرده‌اند که فشرده‌سازی تصویر مبتنی بر انتشار را بدون نیاز به داده‌ی آموزشی، سریع‌تر و کم‌هزینه‌تر می‌کند. نوآوری اصلی این روش…

۱ دقیقه خواندن
ال‌پی‌ان‌اس‌آر: چارچوب نویز بهینه برای بازسازی تصویر در ۴ مرحله

ال‌پی‌ان‌اس‌آر: چارچوب نویز بهینه برای بازسازی تصویر در ۴ مرحله

پژوهشگران روشی نوین برای بازسازی تصاویر با وضوح بالا ارائه داده‌اند که با استفاده از یک چارچوب نظری مبتنی بر تخمین درست‌نمایی بیشینه، نویز بهینه میانی را برای فرآیند انتشار معکوس…

۲ دقیقه خواندن۱
الگوریتم خنده: سیستم هوشمند تولید کامنت‌های طنز برای ویدیوهای کوتاه

الگوریتم خنده: سیستم هوشمند تولید کامنت‌های طنز برای ویدیوهای کوتاه

محققان «الگوریتم خنده» را معرفی کردند؛ چارچوبی چندعامله که کامنت‌های طنز مناسب را برای ویدیوهای کوتاه تولید می‌کند و با نرخ ترجیح انسانی ۸۰ تا ۸۴ درصد از روش‌های پایه پیشی گرفته…

۱ دقیقه خواندن۱