اگر برای تحلیل ویدیوهای حجیم از APIهای گرانقیمت استفاده میکنید، حالا هزینههای شما میتواند تا ۸۰٪ کاهش یابد. شرکت علیبابا با معرفی مدل Qwen3.8-Omni-Flash، بازی هزینههای استنتاج را در مدلهای چندوجهی تغییر داد.
این مدل چندوجهی (Multimodal) — شبیه انسانی است که همزمان میبیند، میشنود و مینویسد تا محیط را درک کند — دقیقاً در زمانی عرضه شده که صنعت از چتباتهای ساده به سمت عاملهای هوش مصنوعی (AI Agents) حرکت میکند. همانطور که در تحلیل قبلی ما دربارهی بهینهسازی جستوجوی گوگل اشاره کردیم، رقابت اکنون بر سر کاهش هزینهٔ نگهداری هوش مصنوعی در مقیاس تولید است. این رقابت قیمتی در واقع پاسخی به استراتژیهای اخیر غولهای فناوری است؛ برای مثال، گوگل نیز پیشتر هزینه API صوتی خود را ۷۰٪ کاهش داد تا جایگاه خود را در برابر OpenAI تثبیت کند.
طبق گزارش ۱9 سپتامبر ۲۰۲۶ از وبسایت the-decoder.com، این مدل بهطور بومی جریانهای صوتی و تصویری را پردازش میکند تا وظایفی مثل خلاصهسازی فیلم یا تدوین ولاگ را انجام دهد. Qwen3.8-Omni-Flash دارای یک پنجرهٔ زمینه (Context Window) — مثل میز کاری بزرگ که مدل میتواند میلیونها توکن را همزمان روی آن باز کند — به اندازه یک میلیون توکن است. این قابلیتهای پردازش سریع و چندوجهی، مشابه همان زیرساختی است که در ادغام مدل Gemini Omni Flash در ابزارهای Firefly برای ارتقای ابزارهای صوتی مشاهده کردیم.
بر اساس مستندات منتشر شده، ساختار قیمتگذاری این مدل به شرح زیر است:
- توکنهای ورودی: ۰.۱۵ دلار بهازای هر میلیون (در مقابل ۰.۷۵ دلار در جمینای).
- توکنهای خروجی: ۰.۴۷ دلار بهازای هر میلیون (در مقابل ۳.۷۵ دلار در جمینای).
- هزینههای رسانهای: ورودی صوتی کمتر از ۰.۰۱ دلار در ساعت و ویدیوهای 720p حدود ۰.۲۰ دلار.

علیبابا این مدل را از طریق Qwen Studio و Qwen Cloud عرضه کرده است. همچنین برای تقویت قابلیتهای عاملها، افزونههای متنباز Qwen-MM-Plugins را منتشر کرد تا ابزارهایی مثل Claude Code بتوانند بازشناسی گوینده و یادداشتبرداری از ویدیو را انجام دهند.
این جنگ قیمتها در واقع «مالیات چندوجهی» را حذف میکند؛ یعنی تحلیل ویدیو در لحظه دیگر برای توسعهدهندگان کوچک گران نیست. با ادغام برنامهریزی و اجرای ابزار در یک مدل، گردشکارهای عاملمحور مثل ترجمه خودکار ویدیو اکنون توجیهپذیر شدهاند.
توسعهدهندگان میتوانند همین حالا تعاملات زنده دوربین و میکروفون را با Qwen-Live Harness آزمایش کنند.
گام بعدی شما
- اگر اپلیکیشنی با تحلیل ویدیو دارید، هزینه استنتاج خود را با نرخهای جدید Qwen مقایسه کنید.
- افزونههای Qwen-MM-Plugins را برای اضافه کردن قابلیت بازشناسی گوینده به عاملهای خود بررسی کنید.
- تغییرات احتمالی قیمت Gemini Flash در ژانویه ۲۰۲۷ را زیر نظر بگیرید.
اما فشار قیمتی علیبابا تنها نیمی از داستان است؛ اثر این رقابت بر سختافزارهای استنتاج را در گزارش بعدی بررسی خواهیم کرد.




گفتگو