
درون سازوکار Remove Sticker برای مدیریت ماسکگذاری دقیق کاربر
یک گردشکار جدید در ویرایش تصاویر، با ترکیب تشخیص خودکار و ماسکگذاری دقیق کاربر، «عدم قطعیت هوش مصنوعی» را به حداقل میرساند. این سامانه بهجای بازسازی کامل تصویر، بر ترمیم…
دستهبندی
تولید تصویر و ویدیو، صدای مصنوعی، هنر و موسیقی هوشمند، بازیها و وجه سرگرمکنندهی AI.
۴۳۴ مقاله منتشر شده

یک گردشکار جدید در ویرایش تصاویر، با ترکیب تشخیص خودکار و ماسکگذاری دقیق کاربر، «عدم قطعیت هوش مصنوعی» را به حداقل میرساند. این سامانه بهجای بازسازی کامل تصویر، بر ترمیم…

سرویس طنز LLM2HUMAN ادعا میکند با دریافت ۲۰ دلار، مدلهای زبانی را به انسانهای فیزیکی تبدیل میکند. این پروژه با نگاهی انتقادی، شکاف میان هوش دیجیتال و دشواریهای ملموس زندگی…

گوگل مدل تولید موسیقی خود را به نسخه Lyria 3.5 بهروزرسانی کرد و قابلیتی برای ویرایش بخشهای خاص آهنگ بدون نیاز به تولید مجدد کل اثر معرفی کرد. این مدل اکنون کنترل دقیقتری روی…

انتخاب مدل مناسب برای تولید ویدیو، بسته به نیاز کاربر از ثبات بصری شخصیتها تا لبخوانی دقیق متغیر است. پلتفرم ofox اکنون امکان سوئیچ میان این مدلها را تنها با تغییر یک رشته متنی…

پکیج متنباز Toolcraft با ارائه یک معماری کامل، فاصله بین خروجیهای متنی مدلها و محیطهای بصری طراحی را میگیرد. این ابزار بهجای قطعات تکه تکه، یک سیستم یکپارچه شامل بوم، خط…

استارتآپ Fish Audio برای خروج از عصر صداهای رباتیک، ۵۰ میلیون دلار سرمایه جذب کرد. این شرکت با ارائه بیش از ۱۵ هزار کنترل دقیق روی لحن و احساس، امکان تولید صداهای انسانی و قابل…

در حالی که ابزارهای جامع هوش مصنوعی breadth یا وسعت عملکردی دارند، PixAI با تمرکز بر پایداری شخصیتهای انیمه، مشکل «تغییر هویت» را حل کرده است. این پلتفرم با ادغام لوراها و…

ابزار Rescript جایگزینی رایگان و متنباز برای Descript است که امکان ویرایش ویدیو را از طریق تغییر متن ترنسکریپت فراهم میکند. این ابزار بهطور کامل در مرورگر اجرا شده و نیاز به…

پروژهی Kurage برای جایگزینی شبکههای تبلیغاتی سنتی، سیستم URL2Earn را معرفی کرد که به کاربران برای اشتراکگذاری لینکها در شبکههای اجتماعی توکن پرداخت میکند. این سیستم با…

یک چارچوب جدید برای تولید میمها، پرامپتها را به عنوان «مشخصات برنامه» تعریف میکند تا خطاهای نوشتاری مدلهای تصویری حذف شوند. این روش با جداسازی سلسلهمراتب بصری از توصیفات…

شرکت Black Forest Labs مدل بنیاد چندوجهی FLUX 3 را معرفی کرد که قادر است ویدیو، صدا و پیشبینیهای حرکتی ربات را تنها با یک مجموعه وزن تولید کند. این مدل با استفاده از معماری…

شرکت xAI حالت جدیدی به نام Quality Mode را برای API مدل Grok Imagine معرفی کرد که بر واقعگرایی و رندر دقیق متن تمرکز دارد. این مدل با قرارگیری در ۵ رتبه اول LMArena، استانداردهای…