پرش به محتوای اصلی
پرش به محتوای مقاله

شیائومی: هزینه API مدل MiMo-V2.5 تا ۹۹٪ کاهش یافت

·۵ خرداد ۱۴۰۵۲ دقیقه مطالعه
اشتراک‌گذاری

اگر برای توسعه برنامه‌های خود از مدل‌های زبانی هزینه می‌پردازید، هزینه‌های عملیاتی شما همین حالا سقوط کرده است. شیائومی (Xiaomi) از ۲۷ مه ۲۰۲۶ قیمت API مدل MiMo-V2.5 را تا ۹۹٪ کاهش داد.

این تصمیم در زمانی می‌افتد که رقابت در دنیای هوش مصنوعی زاینده (Generative AI) از آموزش مدل‌ها به سمت بهینه‌سازی استنتاج (Inference) — یعنی همان لحظه‌ای که مدل واقعاً جواب تولید می‌کند، شبیه خودِ آشپزی و نه دوره‌ی آموزش آشپز — تغییر کرده است. طبق گزارش پلتفرم رسمی این شرکت، شیائومی با حذف تفاوت قیمت بر اساس طول ورودی، می‌خواهد موانع استقرار مدل‌ها در مقیاس بزرگ را از بین ببرد.

همان‌طور که در تحلیل‌های قبلی ما درباره‌ی کاهش هزینه‌های پردازشی در مدل‌های بازمتن اشاره کردیم، رقابت بر سر «ارزان‌تر کردن» توکن‌ها در حال شدت یافتن است. در این به‌روزرسانی، تمام سهمیه‌های فعلی طرح‌های توکنی بازنشانی شدند. همچنین برنامه «Incentive Program» برای سازندگان با توزیع ۱۰۰ تریلیون توکن به پایان رسید.

پلتفرم باز API میمو شیائومی - رونمایی جهانی طرح توکن

بر اساس مستندات فنی شیائومی، دستاوردهای زیر باعث این کاهش قیمت شده‌اند:

  • پیاده‌سازی SWA از طریق SGLang HiCache.
  • کاهش انتقال داده‌های حافظه کلید-مقدار (KV Cache) — شبیه یادداشت‌های سریع یک نویسنده برای جلوگیری از تکرار — به یک‌هفتم سطح قبلی.
  • افزایش ۵ برابری توکن‌های قابل ذخیره‌سازی در حافظه.
  • بهینه‌سازی موازی‌سازی خبره و دسته‌بندی طول ورودی.

پلتفرم باز API میمو شیائومی - رونمایی جهانی طرح توکن

برای توسعه‌دهندگان، این یعنی «مالیات توکن» در پنجره‌های متنی بلند عملاً حذف شده است. شیائومی با بهینه‌سازی رابط سخت‌افزار و نرم‌افزار بین حافظه GPU و SSD، روی حجم کاربر را جایگزین سود بالای هر توکن کرده است.

پلتفرم باز API میمو شیائومی - رونمایی جهانی طرح توکن

این استراتژی، مدل را از یک ابزار گران‌قیمت به یک زیرساخت عمومی تبدیل می‌کند. حالا سایر ارائه‌دهندگان باید یا قیمت‌ها را پایین بیاورند یا کیفیتی به‌مراتب بالاتر ارائه دهند تا هزینه‌های خود را توجیه کنند.

گام بعدی شما

  • اگر کاربر قدیمی هستید، هفته آینده برای دریافت «هدایای غافلگیرکننده» پلتفرم را چک کنید.
  • هزینه‌های استنتاج خود را با سایر ارائه‌دهندگان مقایسه کنید تا فشار قیمتی روی آن‌ها ببینید.
  • مدل‌های با پنجره متنی بلند را برای کارهای حجیم‌تر تست کنید.

اما تأثیر این کاهش قیمت بر استراتژی‌های OpenAI در ماه آینده دیدنی خواهد بود — به تحلیل ما درباره‌ی مدل‌های استدلالی مراجعه کنید.

چرا این موضوع مهم است؟

این اقدام با تکیه بر تخصص شیائومی در یکپارچه‌سازی سخت‌افزار و نرم‌افزار، استانداردهای قیمت‌گذاری کل صنعت را جابه‌جا می‌کند. اکنون سایر شرکت‌ها باید برای توجیه هزینه‌های خود، یا قیمت‌ها را کاهش دهند یا جهشی در کیفیت ارائه کنند.

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.