پرش به محتوای اصلی
پرش به محتوای مقاله

علی‌بابا هزینه API مدل چندوجهی خود را ۸۰٪ نسبت به جمینای کاهش داد

·۲۸ شهریور ۱۴۰۵۱ دقیقه مطالعه۲ بازدید
تیم کیوئن علی‌بابا مدل‌های کیوئن ۳.۸ با وزن‌های باز را تحت مجوز آپاچی ۲.۰ منتشر کرد.
تیم کیوئن علی‌بابا مدل‌های کیوئن ۳.۸ با وزن‌های باز را تحت مجوز آپاچی ۲.۰ منتشر کرد.
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

کاهش ۸۰ درصدی هزینه API در حالی که عملکرد در سطح Gemini Flash حفظ شده است؛ این اولین بار است که تحلیل ویدیو و صوت در مقیاس تجاری تا این حد ارزان می‌شود.

اگر برای تحلیل ویدیوهای حجیم از APIهای گران‌قیمت استفاده می‌کنید، حالا هزینه‌های شما می‌تواند تا ۸۰٪ کاهش یابد. شرکت علی‌بابا با معرفی مدل Qwen3.8-Omni-Flash، بازی هزینه‌های استنتاج را در مدل‌های چندوجهی تغییر داد.

این مدل چندوجهی (Multimodal) — شبیه انسانی است که هم‌زمان می‌بیند، می‌شنود و می‌نویسد تا محیط را درک کند — دقیقاً در زمانی عرضه شده که صنعت از چت‌بات‌های ساده به سمت عامل‌های هوش مصنوعی (AI Agents) حرکت می‌کند. همان‌طور که در تحلیل قبلی ما درباره‌ی بهینه‌سازی جست‌وجوی گوگل اشاره کردیم، رقابت اکنون بر سر کاهش هزینهٔ نگهداری هوش مصنوعی در مقیاس تولید است. این رقابت قیمتی در واقع پاسخی به استراتژی‌های اخیر غول‌های فناوری است؛ برای مثال، گوگل نیز پیش‌تر هزینه API صوتی خود را ۷۰٪ کاهش داد تا جایگاه خود را در برابر OpenAI تثبیت کند.

طبق گزارش ۱9 سپتامبر ۲۰۲۶ از وب‌سایت the-decoder.com، این مدل به‌طور بومی جریان‌های صوتی و تصویری را پردازش می‌کند تا وظایفی مثل خلاصه‌سازی فیلم یا تدوین ولاگ را انجام دهد. Qwen3.8-Omni-Flash دارای یک پنجرهٔ زمینه (Context Window) — مثل میز کاری بزرگ که مدل می‌تواند میلیون‌ها توکن را هم‌زمان روی آن باز کند — به اندازه یک میلیون توکن است. این قابلیت‌های پردازش سریع و چندوجهی، مشابه همان زیرساختی است که در ادغام مدل Gemini Omni Flash در ابزارهای Firefly برای ارتقای ابزارهای صوتی مشاهده کردیم.

بر اساس مستندات منتشر شده، ساختار قیمت‌گذاری این مدل به شرح زیر است:

  • توکن‌های ورودی: ۰.۱۵ دلار به‌ازای هر میلیون (در مقابل ۰.۷۵ دلار در جمینای).
  • توکن‌های خروجی: ۰.۴۷ دلار به‌ازای هر میلیون (در مقابل ۳.۷۵ دلار در جمینای).
  • هزینه‌های رسانه‌ای: ورودی صوتی کمتر از ۰.۰۱ دلار در ساعت و ویدیوهای 720p حدود ۰.۲۰ دلار.

کیوئن ۳.۸-اُمنی-فلش: قیمت پایین‌تر از جمینی فلش گوگل، عملکرد برابر در معیارهای چندوجهی

علی‌بابا این مدل را از طریق Qwen Studio و Qwen Cloud عرضه کرده است. همچنین برای تقویت قابلیت‌های عامل‌ها، افزونه‌های متن‌باز Qwen-MM-Plugins را منتشر کرد تا ابزارهایی مثل Claude Code بتوانند بازشناسی گوینده و یادداشت‌برداری از ویدیو را انجام دهند.

این جنگ قیمت‌ها در واقع «مالیات چندوجهی» را حذف می‌کند؛ یعنی تحلیل ویدیو در لحظه دیگر برای توسعه‌دهندگان کوچک گران نیست. با ادغام برنامه‌ریزی و اجرای ابزار در یک مدل، گردش‌کارهای عامل‌محور مثل ترجمه خودکار ویدیو اکنون توجیه‌پذیر شده‌اند.

توسعه‌دهندگان می‌توانند همین حالا تعاملات زنده دوربین و میکروفون را با Qwen-Live Harness آزمایش کنند.

گام بعدی شما

  • اگر اپلیکیشنی با تحلیل ویدیو دارید، هزینه استنتاج خود را با نرخ‌های جدید Qwen مقایسه کنید.
  • افزونه‌های Qwen-MM-Plugins را برای اضافه کردن قابلیت بازشناسی گوینده به عامل‌های خود بررسی کنید.
  • تغییرات احتمالی قیمت Gemini Flash در ژانویه ۲۰۲۷ را زیر نظر بگیرید.

اما فشار قیمتی علی‌بابا تنها نیمی از داستان است؛ اثر این رقابت بر سخت‌افزارهای استنتاج را در گزارش بعدی بررسی خواهیم کرد.

چرا این موضوع مهم است؟

این اقدام با تکیه بر اعتبار زیرساختی علی‌بابا، سد هزینه‌ای ورود به دنیای عامل‌های چندوجهی را می‌شکند. نتیجه این رقابت، کاهش قیمت کلی خدمات AI در سطح جهانی و فشار بر گوگل برای بازنگری در مدل‌های درآمدی است.

تأثیر برای ایران

به‌دلیل محدودیت‌های API و تحریم‌ها، دسترسی مستقیم توسعه‌دهندگان ایرانی به Qwen Cloud دشوار است، اما کاهش قیمت جهانی، هزینه‌ی استفاده از واسطه‌های API را برای استارتاپ‌های داخلی کاهش می‌دهد.

·نگاه ما
تحریریه دات‌هوش

کاهش شدید قیمت توسط علی‌بابا نشان می‌دهد که مدل‌های چندوجهی از مرحله «اثبات مفهوم» به مرحله «جنگ بازار» رسیده‌اند. این استراتژی احتمالاً برای جذب توسعه‌دهندگانی است که به دلیل هزینه‌های بالای گوگل، از پیاده‌سازی عامل‌های ویدیو-محور در مقیاس واقعی خودداری می‌کردند. در واقع، علی‌بابا در حال تبدیل کردن قابلیت‌های پیشرفته به یک کالا (Commodity) است تا اکوسیستم خود را گسترش دهد.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.