اگر امروز برای پردازشهای حجیم متنی بودجه تخصیص میدهید، صورتحساب ماهانه شما بهزودی سبکتر میشود. طبق گزارش The Token Ledger، هزینه خروجی مدل GPT-5.6 Sol Pro از ۱۵ دلار به ۱۰ دلار بهازای هر یک میلیون توکن کاهش یافت.
این اتفاق در حالی رخ میدهد که صنعت هوش مصنوعی وارد یک جنگ قیمتی تمامعیار بر سر بهینهسازی استنتاج (Inference) — که مثل لحظهٔ نهایی آشپزی است و مدل در آن واقعاً جواب را تولید میکند — شده است. همانطور که در تحلیلهای قبلی ما دربارهی اقتصاد مدلهای زبانی اشاره کردیم، تمرکز بازار از «قدرت خام» به سمت «هزینههای پایدار تولید» در مقیاس سازمانی تغییر کرده است.
بر اساس مستندات منتشرشده در ۲۲ اوت ۲۰۲۶، تغییرات قیمتی کلیدی به شرح زیر است:
- OpenAI: قیمت پرامپت مدل GPT-5.6 Sol Pro به ۲ دلار رسید و نسخههای Batch (دستهای) هزینههای پردازشهای غیرآنی را عملاً نصف کردند.
- DeepSeek: مدل V4 Pro 0423 کاهش شدیدی داشت و هزینه پرامپت آن از ۱.۶۰ دلار به ۰.۴۴۷۵ دلار رسید.
- MoonshotAI: قیمت پرامپت Kimi K2.6 از ۰.۹۵ دلار به ۰.۵۴۱۵ دلار کاهش یافت. این کاهش قیمت در حالی صورت میگیرد که رقابت شدیدی میان مدلهای MoonshotAI و GPT-5.6 در بنچمارکهای تخصصی کدنویسی در جریان است.
- Google: در اقدامی نادر، قیمت پرامپت Gemma 4 31B بهطور جزئی به ۰.۱۰ دلار افزایش یافت.
همزمان، DeepSeek مدل V4 Flash Vision Exp را معرفی کرد که قابلیتهای چندوجهی (Multimodal) — یعنی توانایی درک همزمان متن و تصویر شبیه به حواس انسان — را با هزینه متوسط ۰.۴۴ دلار فراهم میکند.
برای صاحبان کسبوکار، این یعنی «کف قیمتی» برای عاملهای هوش مصنوعی (AI Agents) دوباره پایین آمد. تیمها اکنون میتوانند وظایفی مثل تولید محتوای طولانی یا سنتز دادههای پیچیده را بدون رشد خطی هزینههای ابری گسترش دهند.
توسعهدهندگان باید همین حالا مسیریابی مدلهای خود را بازبینی کنند. با ورود مدلهایی مثل inclusionAI Ling-2.6-flash و IBM Granite 4.0 Micro با نرخهای خیرهکننده ۰.۰۱ دلار، شکاف بین استدلالهای سطح بالا و بهرهوری ارزانقیمت عمیقتر شده است.
گام بعدی شما
- هزینههای فعلی API خود را با نرخهای جدید GPT-5.6 Sol Pro مقایسه کنید.
- برای کارهای غیرآنی، از نسخههای Batch استفاده کنید تا ۵۰٪ در هزینهها صرفهجویی کنید.
- مدلهای ارزانقیمت IBM و inclusionAI را برای وظایف سادهتر جایگزین مدلهای پرمیوم کنید.
اما نبرد واقعی در لایه سختافزاری جریان دارد؛ برای درک اینکه این کاهش قیمتها چگونه ممکن شده، تحلیل ما دربارهی تراشههای Blackwell را بخوانید.




گفتگو