اگر امروز برای تولید گزارشهای طولانی یا کدهای پیچیده به APIهای هوش مصنوعی پول میدهید، صورتحساب شما از این ماه بهشدت ارزانتر میشود. OpenAI با معرفی مدل GPT-5.6 Sol، قیمت توکنهای خروجی را ۳۳٪ کاهش داد تا پذیرش این فناوری در مقیاس صنعتی را تسریع کند.
این مدل در واقع یک مدل زبانی بزرگ (LLM) — شبیه کتابخانهداری که میلیاردها صفحه را خوانده و حالا با همان لحن جواب میدهد — است که برای محیطهای عملیاتی طراحی شده است. همانطور که در تحلیل قبلی ما دربارهی تغییر مدلهای قیمتگذاری Codex به حالت پرداخت به میزان مصرف اشاره کردیم، این اقدام جدید نشاندهنده چرخش راهبردی OpenAI به سمت اقتصادهای منعطفتر است.
طبق مستندات منتشر شده در ۲۲ اوت ۲۰۲۶ در وبسایت developers.openai.com، هزینه توکنهای ورودی به ۴ دلار و هزینه توکنهای خروجی به ۲۰ دلار بهازای هر میلیون توکن کاهش یافته است. این نرخهای تخفیفی تا ۲۱ نوامبر ۲۰۲۶ فعال خواهند بود.
![]()
مدل GPT-5.6 Sol با تاریخ قطع دانش ۱۶ فوریه ۲۰۲۶، مشخصات فنی زیر را ارائه میدهد:
- ظرفیت خروجی: حداکثر ۱۲۸,۰۰۰ توکن (Token) — تکههای کوچکی از متن، شبیه برشهای یک کیک طولانی که مدل تکهتکه میخورد.
- کنترل استدلال: ۶ سطح مختلف، از «بدون استدلال» تا «حداکثر».
- یکپارچگی ابزارها: پشتیبانی بومی از مفسر کد، تولید تصویر و خروجیهای ساختاریافته.
- جریمه قیمت: درخواستهای بیش از ۲۷۲ هزار توکن ورودی، ضریب ۲ برابر برای ورودی و ۱.۵ برابر برای خروجی دریافت میکنند.
![]()
به گزارش منابع فنی، مهمترین تغییر برای توسعهدهندگان، کنترل دقیق روی میزان تلاش برای استدلال است. این قابلیت به تیمها اجازه میدهد برای کارهای ساده روی سرعت و برای پروژههای حرفهای روی عمق تحلیل تمرکز کنند، بدون اینکه نیاز باشد مدل خود را عوض کنند. این یعنی استنتاج (Inference) — لحظهای که مدل واقعاً جواب تولید میکند، شبیه خودِ آشپزی و نه دورهی آموزش آشپز — اکنون بهینهتر از همیشه است. در حالی که OpenAI در بخش مدلهای زبانی پیشروی میکند، چالشهای متفاوتی در زمینه دقت مدلهای بازشناسی گفتار همچنان برای این شرکت باقی مانده است.
این استراتژی قیمتی نشان میدهد که OpenAI سهم بازار و پذیرش در مقیاس تولید را بر سود فوری هر توکن ترجیح داده است. تخفیف تهاجمی روی توکنهای خروجی بهطور مستقیم به نفع اپلیکیشنهایی است که گزارشهای مفصل یا پایگاههای کد پیچیده تولید میکنند.
گام بعدی شما
- لایههای فعلی API خود را بررسی کنید تا ببینید محدودیتهای جدید (تا ۴۰ میلیون توکن در دقیقه برای Tier 5) چگونه بر برنامههای مقیاسدهی شما اثر میگذارد.
- تسکهای خود را بر اساس ۶ سطح استدلال دستهبندی کنید تا هزینه و سرعت را بهینه کنید.
- برای خروجیهای طولانیتر از ۱۰۰ هزار توکن، ساختار درخواستها را بازبینی کنید تا در دام جریمههای قیمتی نیفتید.
اما داستان سختافزاری این تحول حتی شگفتانگیزتر است — به تحلیل ما دربارهی تراشههای Blackwell مراجعه کنید.




گفتگو