پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۱٬۳۵۰ مقاله منتشر شده

۳۰ هزار آهنگ سونی که از هوش مصنوعی Udio شکایت کرده

سونی موسیقی: Udio بیش از ۳۰ هزار اثر دارای کپی‌رایت را دزدیده است

شرکت سونی موسیقی در دعوایی جدید مدعی شد که Udio برای آموزش مدل‌های خود از ۳۰ هزار آهنگ بدون اجازه استفاده کرده است. این شرکت با استفاده از تکنولوژی اثرانگشت صوتی، ردپای آثار…

۱ دقیقه خواندن۱
ویژگی جدید اپلیکیشن دوربین ادوبی با هوش مصنوعی عکس‌های شما را نقد می‌کند

Project Indigo چگونه تحلیل‌های حرفه‌ای عکاسی را به آیفون می‌آورد؟

ادوبی در به‌روزرسانی اپلیکیشن آزمایشی Project Indigo، ابزارهای نقادانه هوش مصنوعی را برای آموزش عکاسان موبایل معرفی کرد. این قابلیت‌ها به‌جای تکیه بر دستورات متنی، از دکمه‌های…

۳ دقیقه خواندن
کارگردان «ناحیه ۹» نخستین فیلم کوتاه کاملاً تولیدشده با هوش مصنوعی را منتشر کرد.

نیل بلومکمپ نخستین فیلم کوتاه کاملاً ساخته‌شده با هوش مصنوعی را منتشر کرد

کارگردان مشهور نیل بلومکمپ با انتشار فیلم کوتاه ۱۳ دقیقه‌ای Nightborne، مرزهای سینماتوگرافی مبتنی بر هوش مصنوعی را جابه‌جا کرد. این پروژه که توسط استودیوی جدید او (Barley Studios)…

۱ دقیقه خواندن۱
شروع کار با AceKit برای عوامل کدنویسی
آموزش کاربردی

۲ قابلیت کلیدی AceKit در یکپارچه‌سازی ابزارهای جست‌وجو و تولید ویدیو

ابزار AceKit امکان اتصال عامل‌های کدنویسی مانند Claude Code و Cursor را به سرویس‌های خارجی برای تولید ویدیو و جست‌وجوی وب فراهم می‌کند. این سیستم نیاز به نوشتن اسکریپت‌های دستی…

۵ دقیقه خواندن۲
پیش‌نمایش کیوئن ۳.۸-مکس علی‌بابا: مدل چندوجهی ۲.۴ تریلیون پارامتری، چند روز پس از عرضه کیمی K3 مون‌شات

علی‌بابا مدل Qwen3.8-Max با ۲.۴ تریلیون پارامتر را رونمایی کرد

شرکت علی‌بابا پیش‌نمایشی از مدل چندوجهی Qwen3.8-Max با ۲.۴ تریلیون پارامتر ارائه داد تا با پیشرفته‌ترین سیستم‌های جهان رقابت کند. با وجود دسترسی پولی، این شرکت هنوز بنچمارک‌های…

۶ دقیقه خواندن۲
پلتفرم هوشمند عامل صوتی هوش مصنوعی در حال پاسخگویی به تماس پزشکی
آموزش کاربردی

چهار لایه‌ی فنی برای تبدیل چت‌بات‌ها به عامل‌های صوتی کلینیکی

تولید عامل‌های صوتی در حوزه سلامت نیازمند عبور از چت‌بات‌های عمومی و استقرار موتورهایی است که اصطلاحات پزشکی و پرونده‌های الکترونیک بیمار را در محیطی امن مدیریت کنند. این فرآیند…

۲ دقیقه خواندن
چرا دیگر تبدیل گفتار به متن را «فقط یک API هوش مصنوعی» نمی‌دانیم
آموزش کاربردی

پایدارسازی خط تولید صوت؛ برنده واقعی در رقابت سرویس‌های تبدیل گفتار به متن

توسعه محصولات تبدیل گفتار به متن دیگر به دقت مدل‌ها وابسته نیست، بلکه موفقیت در گرو طراحی زیرساخت‌های پردازش صوتی و مدیریت صف‌های پردازشی است. در حالی که عملکرد مدل‌ها به اشباع…

۳ دقیقه خواندن۲