پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۸۷۸ مقاله منتشر شده

شروع کار با AceKit برای عوامل کدنویسی
آموزش کاربردی

۲ قابلیت کلیدی AceKit در یکپارچه‌سازی ابزارهای جست‌وجو و تولید ویدیو

ابزار AceKit امکان اتصال عامل‌های کدنویسی مانند Claude Code و Cursor را به سرویس‌های خارجی برای تولید ویدیو و جست‌وجوی وب فراهم می‌کند. این سیستم نیاز به نوشتن اسکریپت‌های دستی…

۵ دقیقه خواندن
پیش‌نمایش کیوئن ۳.۸-مکس علی‌بابا: مدل چندوجهی ۲.۴ تریلیون پارامتری، چند روز پس از عرضه کیمی K3 مون‌شات

علی‌بابا مدل Qwen3.8-Max با ۲.۴ تریلیون پارامتر را رونمایی کرد

شرکت علی‌بابا پیش‌نمایشی از مدل چندوجهی Qwen3.8-Max با ۲.۴ تریلیون پارامتر ارائه داد تا با پیشرفته‌ترین سیستم‌های جهان رقابت کند. با وجود دسترسی پولی، این شرکت هنوز بنچمارک‌های…

۶ دقیقه خواندن
پلتفرم هوشمند عامل صوتی هوش مصنوعی در حال پاسخگویی به تماس پزشکی
آموزش کاربردی

چهار لایه‌ی فنی برای تبدیل چت‌بات‌ها به عامل‌های صوتی کلینیکی

تولید عامل‌های صوتی در حوزه سلامت نیازمند عبور از چت‌بات‌های عمومی و استقرار موتورهایی است که اصطلاحات پزشکی و پرونده‌های الکترونیک بیمار را در محیطی امن مدیریت کنند. این فرآیند…

۲ دقیقه خواندن
چرا دیگر تبدیل گفتار به متن را «فقط یک API هوش مصنوعی» نمی‌دانیم
آموزش کاربردی

پایدارسازی خط تولید صوت؛ برنده واقعی در رقابت سرویس‌های تبدیل گفتار به متن

توسعه محصولات تبدیل گفتار به متن دیگر به دقت مدل‌ها وابسته نیست، بلکه موفقیت در گرو طراحی زیرساخت‌های پردازش صوتی و مدیریت صف‌های پردازشی است. در حالی که عملکرد مدل‌ها به اشباع…

۳ دقیقه خواندن۲