
سونی موسیقی: Udio بیش از ۳۰ هزار اثر دارای کپیرایت را دزدیده است
شرکت سونی موسیقی در دعوایی جدید مدعی شد که Udio برای آموزش مدلهای خود از ۳۰ هزار آهنگ بدون اجازه استفاده کرده است. این شرکت با استفاده از تکنولوژی اثرانگشت صوتی، ردپای آثار…
موضوع
Models that natively process text+image+audio+video
۱٬۳۵۰ مقاله منتشر شده

شرکت سونی موسیقی در دعوایی جدید مدعی شد که Udio برای آموزش مدلهای خود از ۳۰ هزار آهنگ بدون اجازه استفاده کرده است. این شرکت با استفاده از تکنولوژی اثرانگشت صوتی، ردپای آثار…

ادوبی در بهروزرسانی اپلیکیشن آزمایشی Project Indigo، ابزارهای نقادانه هوش مصنوعی را برای آموزش عکاسان موبایل معرفی کرد. این قابلیتها بهجای تکیه بر دستورات متنی، از دکمههای…

نرمافزار Fooocus رابطی ساده و مشابه Midjourney را برای اجرای مدلهای قدرتمندی مثل FLUX.2 و SDXL روی سیستمهای ویندوزی فراهم میکند. این راهکار هزینههای اشتراک ابری را حذف کرده و…

کارگردان مشهور نیل بلومکمپ با انتشار فیلم کوتاه ۱۳ دقیقهای Nightborne، مرزهای سینماتوگرافی مبتنی بر هوش مصنوعی را جابهجا کرد. این پروژه که توسط استودیوی جدید او (Barley Studios)…

ادوبی با معرفی بخش AI Playground در اپلیکیشن Indigo، ویرایش زاینده و حذف اشیا را به عکاسان موبایل میآورد. این بهروزرسانی بهجای مدلهای Firefly، از مدل Nano Banana گوگل استفاده…

انویدیا مدل Cosmos 3 Edge را برای کنترل رباتها و بینایی ماشین در لبه شبکه عرضه کرد. این مدل ۴ میلیارد پارامتری با ترکیب استدلال و شبیهسازی، امکان پیشبینی و اجرای اقدامات فیزیکی…

ابزار AceKit امکان اتصال عاملهای کدنویسی مانند Claude Code و Cursor را به سرویسهای خارجی برای تولید ویدیو و جستوجوی وب فراهم میکند. این سیستم نیاز به نوشتن اسکریپتهای دستی…

آزمایشگاه Yang AI مدل بنیادی Inertia-1 را معرفی کرد که قادر است حرکات انسانی را بدون نیاز به آموزش مجدد، در هر نقطه از بدن و با هر نوع حسگری تحلیل کند. این مدل با بهرهگیری از ۱۸…

شرکت علیبابا پیشنمایشی از مدل چندوجهی Qwen3.8-Max با ۲.۴ تریلیون پارامتر ارائه داد تا با پیشرفتهترین سیستمهای جهان رقابت کند. با وجود دسترسی پولی، این شرکت هنوز بنچمارکهای…

تولید عاملهای صوتی در حوزه سلامت نیازمند عبور از چتباتهای عمومی و استقرار موتورهایی است که اصطلاحات پزشکی و پروندههای الکترونیک بیمار را در محیطی امن مدیریت کنند. این فرآیند…

یک توسعهدهنده با ساخت رابطی کمحجم، محدودیتهای ثبتنام و کندی Seedance را دور زد. این ابزار امکان تولید سریع و بدون واترمارک ویدیوهای متن-به-ویدیو و تصویر-به-ویدیو را فراهم…

توسعه محصولات تبدیل گفتار به متن دیگر به دقت مدلها وابسته نیست، بلکه موفقیت در گرو طراحی زیرساختهای پردازش صوتی و مدیریت صفهای پردازشی است. در حالی که عملکرد مدلها به اشباع…