پرش به محتوای اصلی
پرش به محتوای مقاله

مدل GPT-5.6 Sol هزینه استنتاج را به یک‌سوم رقیب کاهش داد

·۱۸ تیر ۱۴۰۵۲ دقیقه مطالعه
مقایسه عملکرد و هزینه مدل‌های GPT-5.6 Sol و Fable 5 در بنچمارک‌های ترکیبی
مقایسه عملکرد و هزینه مدل‌های GPT-5.6 Sol و Fable 5 در بنچمارک‌های ترکیبی
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر استراتژیک OpenAI از اولویت «بالاترین کیفیت» به «بهترین نسبت کیفیت به قیمت» و معرفی ساختار تخفیفی ۹۰ درصدی برای Cache-read.

اگر امروز برای پردازش‌های سنگین AI بودجه می‌بندید، هزینه‌های شما به‌شدت کاهش می‌یابد. قیمت هر عملیات در مدل جدید OpenAI تنها ۱.۰۴ دلار است؛ یعنی حدود یک‌سوم مبلغ ۲.۷۵ دلاری که رقیب مستقیمش، Claude Fable 5، دریافت می‌کند.

طبق گزارش ۹ جولای ۲۰۲۶، این سقوط قیمت، کف اقتصادی را برای هوش مصنوعی‌های سطح بالا در محیط‌های تولیدی بازتعریف می‌کند. OpenAI اکنون استراتژی خود را از «افزایش صرف قدرت» به «بهینه‌سازی تهاجمی هزینه» تغییر داده است. این مدل زبانی بزرگ (LLM) — مثل کتابخانه‌داری که میلیاردها صفحه را خوانده و حالا با همان لحن جواب می‌دهد — برای سازمان‌هایی طراحی شده که به دنبال هوش سطح اول هستند اما نمی‌خواهند هزینه‌های گزاف رقبا را بپردازند. همان‌طور که در تحلیل‌های قبلی ما درباره‌ی استقرار مدل‌های جدید OpenAI اشاره کردیم، تمرکز این شرکت اکنون بر تسخیر بازار سازمانی است. این رویکرد در واقع تکمیلِ استراتژی جدید این شرکت است که در آن OpenAI با سری GPT-5.6 تمرکز خود را از گفتگو به اجرای عملیات تغییر داد تا کاربرد عملی AI را در کسب‌وکارها افزایش دهد.

بر اساس داده‌های Artificial Analysis، مدل Sol (max) در شاخص هوش ۵۹ امتیاز کسب کرده که تنها یک امتیاز با Claude Fable 5 فاصله دارد. جزئیات عملکرد فنی این مدل در موارد زیر برجسته است:

  • شاخص عامل‌های کدنویسی: Sol با کسب ۸۰ امتیاز در محیط Codex، رتبه اول را از آن خود کرد و Fable 5 با ۷۷ امتیاز در جایگاه دوم قرار گرفت.
  • AA-Briefcase: این مدل بالاترین امتیاز «Elo ارائه» را برای وظایف اداری به‌دست آورد، هرچند در رتبه‌بندی کلی هنوز پشت سر رقیب است.
  • کارایی: سام آلتمن، مدیرعامل OpenAI، اعلام کرد که Sol در وظایف کدنویسی عامل‌محور (Agentic) — شبیه به دستیاری که خودش تصمیم می‌گیرد چه ابزاری را کجا به کار ببرد — تا ۵۴٪ توکن‌های خروجی کمتری نسبت به مدل‌های مشابه مصرف می‌کند.

مقایسه عملکرد و هزینه مدل‌های GPT-5.6 Sol و Fable 5 در بنچمارک‌های ترکیبی

OpenAI برای کاهش بیشتر هزینه‌های بلندمدت، سیستم جدیدی برای پرداخت هزینهٔ نوشتن در حافظه موقت (Cache-write) معرفی کرده است که تخفیف ۹۰ درصدی برای خواندن از حافظه (Cache-read) در نظر می‌گیرد. همچنین برای دسترسی لایه‌ای، دو مدل Terra (با هزینه ۰.۵۵ دلار) و Luna (۰.۲۱ دلار) عرضه شدند که به‌ترتیب ۵۰ و ۸۰ درصد ارزان‌تر از Sol هستند.

مقایسه عملکرد و هزینه مدل‌های زبانی بزرگ در بنچمارک‌های تجمعی

این جنگ قیمت‌ها نشان‌دهنده تغییری در رقابت تسلیحاتی AI است. هرچند OpenAI هنوز گران‌تر از Muse 1.1 متا یا Grok 4.5 xAI است، اما اکنون مستقیماً حاشیه سود Anthropic را هدف گرفته است. برای صاحبان کسب‌وکار، این یعنی نسبت «هوش به دلار» به‌شدت بالا رفته و اجرای جریان‌های کاری پیچیده و عامل‌محور در مقیاس واقعی، به‌یک‌باره اقتصادی شده است.

گام بعدی شما

  • اگر از مدل‌های گران‌قیمت Claude برای کدنویسی استفاده می‌کنید، هزینه استنتاج (Inference) — لحظه‌ای که مدل واقعاً جواب تولید می‌کند، شبیه خودِ آشپزی نه دوره آموزش آشپز — خود را با Sol مقایسه کنید.
  • ساختار جدید Cache-write را برای کاهش هزینه‌های تکراری در اپلیکیشن‌های سازمانی بررسی کنید.
  • مدل Luna را برای وظایف ساده‌تر ارزیابی کنید تا هزینه‌ها را تا ۸۰٪ کاهش دهید.

اما این کاهش قیمت‌ها ممکن است واکنش تندتری را در بازار مدل‌های بازمتن برانگیزد؛ به تحلیل ما درباره‌ی استراتژی‌های مدل‌های لاما مراجعه کنید.

چرا این موضوع مهم است؟

این اقدام با تکیه بر اعتبار داده‌های Artificial Analysis، مدل اقتصادی استقرار AI را تغییر می‌دهد. کاهش ۶۶ درصدی هزینه‌ها باعث می‌شود ابزارهای خودکار پیچیده از حالت آزمایشی خارج شده و به استانداردی در کسب‌وکارهای کوچک تبدیل شوند.

تأثیر برای ایران

به‌دلیل محدودیت‌های API و تحریم‌ها، دسترسی مستقیم به مدل‌های Sol برای توسعه‌دهندگان ایرانی دشوار است و باید از طریق واسطه‌ها انجام شود.

·نگاه ما
تحریریه دات‌هوش

تمرکز OpenAI بر کاهش هزینه به‌جای جهش در بنچمارک‌ها نشان می‌دهد که ما از عصر «نمایش قدرت» وارد عصر «بهینه‌سازی صنعتی» شده‌ایم. این حرکت عملاً ارزش مدل‌های رقیب را که فقط بر پایه کیفیت هستند، زیر سؤال می‌برد و مدل‌های «کافی و ارزان» را به برنده میدان تبدیل می‌کند. احتمالاً شاهد ظهور مدل‌های Light یا Mini از سوی Anthropic خواهیم بود تا جلوی ریزش مشتریان سازمانی گرفته شود.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.