
اپلیکیشن اندروید Runway منتشر شد اما ابزارهای حرفهای در دسکتاپ ماندند
شرکت Runway دسترسی به ابزارهای خود را با انتشار اپلیکیشن اندروید گسترش داد، اما قابلیتهای کلیدی مانند ماسکگذاری دقیق و گردشکارهای سفارشی همچنان محدود به نسخه دسکتاپ هستند.…
دستهبندی
تولید تصویر و ویدیو، صدای مصنوعی، هنر و موسیقی هوشمند، بازیها و وجه سرگرمکنندهی AI.
۶۹۲ مقاله منتشر شده

شرکت Runway دسترسی به ابزارهای خود را با انتشار اپلیکیشن اندروید گسترش داد، اما قابلیتهای کلیدی مانند ماسکگذاری دقیق و گردشکارهای سفارشی همچنان محدود به نسخه دسکتاپ هستند.…

یک ابزار جدید مبتنی بر هوش مصنوعی، طراحی نشانهای خانوادگی و نمادهای فانتزی را برای غیرطراحان ممکن کرده است. این سیستم با تمرکز بر قواعد سختگیرانه هنر نشانشناسی، نیاز به آزمون و…

بررسی بیش از ۱,۵۰۰ پرامپت نشان میدهد که برای خروج از ظاهر «مصنوعی» تصاویر تجاری، باید بهجای صفتهای کلی، بر جزئیات فیزیکی و برندسازی تخیلی تمرکز کرد. این یافتهها نقشهای برای…

پژوهشگران دانشگاه ماهیدول مدل رایگان و محلی ThonburianTTS را برای شبیهسازی طبیعی صدای تایلندی منتشر کردند. این مدل امکان کپی صدای Zero-shot را تنها با ۵ تا ۱۰ ثانیه نمونه صوتی و…

نسخه V8.2 میدجرنی کیفیت بصری را ارتقا داده اما به دلیل نبود پشتیبانی بومی از ارجاع به شخصیت، کاربران حرفهای را مجبور به استفاده از یک خط لوله دوگانه بین V8.2 و V7 میکند. این نقص…

Kling از طریق API جدید Lip Sync در پلتفرم Ace Data Cloud، امکان تبدیل تصاویر ثابت به ویدیوهای دارای گفتار را فراهم کرد. این ابزار به توسعهدهندگان اجازه میدهد تا حرکات لب…

یک توسعهدهنده با استفاده از چارچوب متنباز HyperFrames، فرآیند ساخت ویدیوهای محصول را از محیطهای گرافیکی به خط لولهای متنی منتقل کرد. این روش به عاملهای هوش مصنوعی اجازه…

شرکت xAI مدل Imagine Image 2.0 را برای تولید تصاویر با کیفیت بالا منتشر کرد که اکنون تنها یک رتبه با GPT-Image-2 فاصله دارد. این بهروزرسانی با تمرکز بر ابزارهای ویرایش حرفهای،…

یک استودیو پرتره جدید در AI Model Hub با جایگزینی فیلترهای تکمرحلهای با یک «تیم مجازی»، عکسهای پروفایل با بافت واقعی پوست تولید میکند. این رویکرد با حفظ منافذ پوست، اثر «دره…

شرکت xAI مدل Grok Imagine Image 2.0 را با قابلیتهای پیشرفته ویرایش منطقهای و ارجاع چندتصویری معرفی کرد. این مدل در حال حاضر در رتبهی دوم جدولهای جهانی قرار دارد و تنها با مدل…

ابزار متنباز GPT-SoVITS امکان شبیهسازی صدای انسان را تنها با یک دقیقه داده صوتی و بهصورت کاملاً محلی فراهم میکند. این ابزار با حذف وابستگی به سرویسهای ابری، جایگزینی رایگان و…

ابزارهای متنباز تبدیل متن به گفتار به نقطهای رسیدهاند که مدلهایی مثل GPT-SoVITS و ChatTTS میتوانند در شبیهسازی صدا و تولید محتوای محاورهای با سرویسهای تجاری برابری کنند.…