پرش به محتوای اصلی
پرش به محتوای مقاله

Grok 4.6 در برابر GPT-5.6؛ برابری عملکرد با بهای کمتر

·۲۲ مرداد ۱۴۰۵۱ دقیقه مطالعه۲ بازدید
گروک ۴.۶ اسپیس‌ایکس‌ای‌آی در سطح بهترین مدل اوپن‌ای‌آی با قیمت کمتر
گروک ۴.۶ اسپیس‌ایکس‌ای‌آی در سطح بهترین مدل اوپن‌ای‌آی با قیمت کمتر
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

دستیابی به عملکرد برابر با GPT-5.6 Sol در حالی که هزینه استنتاج ۶۰٪ کاهش یافته است؛ این اولین بار است که مدل‌های سطح Frontier با قیمت مدل‌های Commodity عرضه می‌شوند.

اگر امروز برای مدل‌های پیشرو هزینه می‌پردازید، احتمالاً با کاهش شدید قیمت‌ها در بازار مواجه خواهید شد. شرکت xAI در ۱۲ اوت ۲۰۲۶ مدل Grok 4.6 را منتشر کرد که هزینه استنتاج (Inference) — لحظه‌ای که مدل واقعاً جواب تولید می‌کند، شبیه به خودِ آشپزی و نه دوره‌ی آموزش آشپز — را ۶۰٪ کاهش داده است.

این تحول در حالی رخ می‌دهد که صنعت از تعقیب «ضریب هوشی» خام به سمت بهینه‌سازی برای اجرای عامل‌محور (Agentic) — یعنی مدل‌هایی که مثل یک کارمند مستقل، کارهای چندمرحله‌ای را مدیریت می‌کنند — حرکت می‌کند. همان‌طور که در تحلیل قبلی ما درباره‌ی ادغام کدنویسی در ابزارهای هوش مصنوعی اشاره کردیم، رقابت اکنون بر سر این است که مدل‌ها چطور بدون دخالت انسان، گردش‌های کاری پیچیده را در کامپیوتر پیش ببرند. این رویکرد در ادامه رقابت شدید Grok و GPT در زمینه کدنویسی پیچیده و عامل‌های خودکار قرار دارد که پیش‌تر به آن پرداخته بودیم.

طبق گزارش Artificial Analysis (AA)، مدل Grok 4.6 امتیاز ۶۱ را کسب کرد که دقیقاً با امتیاز GPT-5.6 Sol برابری می‌کند. در این رتبه‌بندی، تنها مدل‌های Claude Opus 5 (امتیاز ۶۳) و Claude Fable 5 (امتیاز ۶۲) از Grok پیشی گرفته‌اند. این برتری فنی در حالی است که Claude Opus 5 پیش از این در بنچمارک‌های کدنویسی از مدل Fable 5 پیشی گرفته بود و استانداردهای جدیدی را تعریف کرد.

گروک ۴.۶ اسپیس‌ایکس‌ای‌آی در سطح بهترین مدل اوپن‌ای‌آی با قیمت کمتر

بر اساس مستندات منتشر شده، جزئیات عملکرد و قیمت این مدل به شرح زیر است:

  • کارایی عامل‌محور: در محک GDPval-AA v2 برای کارهای دانشی واقعی، Grok 4.6 با امتیاز Elo ۱۷۵۳ رتبه دوم را دارد. این مدل کارهای پیچیده را در ۵۳ گام به پایان می‌رساند، در حالی که Claude Opus 5 به ۱۰۳ گام نیاز دارد.
  • ساختار هزینه: قیمت این مدل ۲ دلار برای هر میلیون توکن (Token) — تکه‌های کوچکی از متن، شبیه برش‌های یک کیک که مدل تکه‌تکه می‌خورد — ورودی و ۶ دلار برای توکن‌های خروجی است. این رقم در مقایسه با GPT-5.6 Sol (۵/۳۰ دلار) بسیار ارزان‌تر است. این استراتژی کاهش هزینه یادآور رویکرد DeepSeek V4 Flash بود که با هزینه‌ای ۶۰٪ کمتر، توانست با GPT-5.6 Luna برابری کند.
  • دسترسی: این مدل هم‌اکنون از طریق API، Cursor، Grok Build و شرکایی مثل Vercel و Cloudflare در دسترس است.

برای کاربران تجاری، این یعنی «مالیات هوش» در حال ناپدید شدن است. دیگر مجبور نیستید بین یک مدل ارزان اما متوسط و یک مدل پیشرو اما گران انتخاب کنید. xAI با ارائه نتایج سطح بالا با قیمتی اندک، جنگ قیمتی را به نفع توسعه‌دهندگان عامل‌های هوش مصنوعی (AI Agents) آغاز کرده است.

باید منتظر واکنش OpenAI و Anthropic به این فشار قیمتی بود. نبرد بعدی بر سر این خواهد بود که آیا این کاهش هزینه‌ها در معماری‌های استدلالی سنگین‌تر نیز حفظ می‌شود یا خیر.

گام بعدی شما

  • اگر توسعه‌دهنده هستید، هزینه استنتاج مدل‌های فعلی خود را با نرخ‌های Grok 4.6 مقایسه کنید.
  • کارایی مدل را در گردش‌های کاری چندمرحله‌ای (Multi-step) در Cursor تست کنید.
  • تغییرات قیمت مدل‌های OpenAI را در هفته‌های آینده رصد کنید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این اتفاق با تکیه بر داده‌های اعتباربخش Artificial Analysis، توازن قدرت را از مدل‌های انحصاری گران‌قیمت به سمت مدل‌های بهینه منتقل می‌کند. توسعه‌دهندگان اکنون می‌توانند بدون نگرانی از هزینه‌های سرسامیز، عامل‌های پیچیده را در محیط تولید مستقر کنند.

تأثیر برای ایران

به‌دلیل محدودیت‌های API و تحریم‌ها، دسترسی مستقیم توسعه‌دهندگان ایرانی به Grok 4.6 دشوار است، اما کاهش قیمت جهانی، هزینه‌ی استفاده از واسطه‌های API را برای استارتاپ‌های داخلی کاهش می‌دهد.

·نگاه ما
تحریریه دات‌هوش

کاهش ۶۰ درصدی هزینه در سطح مدل‌های پیشرو نشان می‌دهد که بهینه‌سازی‌های معماری اکنون بر افزایش اندازه مدل‌ها اولویت یافته است. xAI با این استراتژی، سد ورود برای استقرار عامل‌های خودکار در مقیاس وسیع را می‌شکند و مدل‌های گران‌قیمت را به بن‌بست اقتصادی می‌کشاند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.