
مدل Imagine Image 2.0 جایگاه دوم جهانی را در بنچمارکهای تصویری گرفت
شرکت xAI مدل Imagine Image 2.0 را برای تولید تصاویر با کیفیت بالا منتشر کرد که اکنون تنها یک رتبه با GPT-Image-2 فاصله دارد. این بهروزرسانی با تمرکز بر ابزارهای ویرایش حرفهای،…
دستهبندی
تولید تصویر و ویدیو، صدای مصنوعی، هنر و موسیقی هوشمند، بازیها و وجه سرگرمکنندهی AI.
۴۳۳ مقاله منتشر شده

شرکت xAI مدل Imagine Image 2.0 را برای تولید تصاویر با کیفیت بالا منتشر کرد که اکنون تنها یک رتبه با GPT-Image-2 فاصله دارد. این بهروزرسانی با تمرکز بر ابزارهای ویرایش حرفهای،…

یک استودیو پرتره جدید در AI Model Hub با جایگزینی فیلترهای تکمرحلهای با یک «تیم مجازی»، عکسهای پروفایل با بافت واقعی پوست تولید میکند. این رویکرد با حفظ منافذ پوست، اثر «دره…

شرکت xAI مدل Grok Imagine Image 2.0 را با قابلیتهای پیشرفته ویرایش منطقهای و ارجاع چندتصویری معرفی کرد. این مدل در حال حاضر در رتبهی دوم جدولهای جهانی قرار دارد و تنها با مدل…

ابزار متنباز GPT-SoVITS امکان شبیهسازی صدای انسان را تنها با یک دقیقه داده صوتی و بهصورت کاملاً محلی فراهم میکند. این ابزار با حذف وابستگی به سرویسهای ابری، جایگزینی رایگان و…

ابزارهای متنباز تبدیل متن به گفتار به نقطهای رسیدهاند که مدلهایی مثل GPT-SoVITS و ChatTTS میتوانند در شبیهسازی صدا و تولید محتوای محاورهای با سرویسهای تجاری برابری کنند.…

دقت همگامسازی لبها در Seedance معمولاً در صحنههای طولانی به دلیل نقص در خط لوله تولید، نه محدودیت مدل، کاهش مییابد. ZipX با خرد کردن صحنهها به ضربآهنگهای کوچک و تثبیت صدا…

فنیکس فلکسین پس از ماهها انکار، اعتراف کرد که آهنگ hit خود به نام Rubberz را با ابزارهای هوش مصنوعی ساخته است. این پذیرش پس از افشای فنی توسط یک تهیهکننده و شناسایی اثر توسط…

پلتفرم Roku با استارتاپ Fairground برای پخش ۲۴ ساعته ویدیوهای تولید شده توسط هوش مصنوعی وارد همکاری شد. این تجربه شکاف عمیق میان توانایی تولید انبوه محتوا و فقدان کیفیت بصری…

کریس دافی ترجمهای کامل از اثر کلاسیک اودیسه را با استفاده از مدل Claude (نسخه Fable 5) منتشر کرد. این پروژه ۱۲,۱۰۷ خط متن یونانی را بهصورت یکبهیک به انگلیسی نگاشته و با…

یک گردشکار جدید در هوش مصنوعی امکان تولید ویدیوهای خوانندگی واقعگرایانه را تنها با یک عکس و یک فایل صوتی فراهم میکند. این ابزار همگامسازی لبها و حرکات صورت را بدون نیاز به…

ساخت یک شخصیت دیجیتال باورپذیر نیازمند چیزی فراتر از تصاویر باکیفیت است و بر تداوم صدا، پوشش و رفتار استوار است. کمال فنی اغلب منجر به اثر «درهٔ ناآشنا» میشود و برای رسیدن به…

مدل جدید بایتدنس با حذف نیاز به تدوین و اتصال کلیپهای کوتاه، ویدیوهای ۳۰ ثانیهای پیوسته تولید میکند. این ابزار با درک چند-مرجعی و هماهنگی با صدا، فرآیند تولید محتوای UGC را…