پرش به محتوای اصلی
پرش به محتوای مقاله

Grok 4.6 با قیمت کمتر و دسترسی گسترده به GitHub Copilot آمد

·۲۴ مرداد ۱۴۰۵۴ دقیقه مطالعه۲ بازدید
Grok 4.6 در هشت محیط توسعه GitHub Copilot عرضه شد
Grok 4.6 در هشت محیط توسعه GitHub Copilot عرضه شد
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر استراتژی xAI از رقابت بر سر قدرت خالص به رقابت بر سر «توزیع گسترده در IDEهای غیر-VS Code» و «قیمت استنتاج به‌شدت پایین‌تر» نسبت به مدل‌های پرچم‌دار دیگر.

اگر امروز برای ابزارهای کدنویسی AI هزینه پرداخت می‌کنید، احتمالاً به‌زودی با گزینه‌ای مواجه می‌شوید که هم ارزان‌تر است و هم در محیط‌های متنوع‌تری کار می‌کند. مدل Grok 4.6 تنها دو روز پس از عرضه رسمی در ۱۲ اوت ۲۰۲۶، از ۱۴ اوت ۲۰۲۶ در GitHub Copilot فعال شد تا به ابزاری کلیدی برای جریان‌های کاری عامل‌محور (Agentic) تبدیل شود. این مدل اکنون از طریق منوی انتخاب مدل (Model Picker) قابل دسترسی است و xAI با این اقدام، جدیدترین پرچم‌دار خود را به عنوان ابزاری اصلی برای استدلال‌های بلندمدت و گردش‌های کاری خودکار معرفی کرده است.

زمینه: گذار به کدنویسی عامل‌محور

دنیای دستیارهای کدنویسی در حال گذار از تکمیل خودکار ساده به سمت عامل‌های هوش مصنوعی (AI Agents) است؛ یعنی سیستم‌هایی شبیه به یک کارآموز خبره که می‌تواند بدون نیاز به نظارت لحظه‌ای، چندین مرحله از یک پروژه پیچیده را به‌تنهایی پیش ببرد و بدون گم کردن مسیر (Drifting)، وظایف چندمرحله‌ای را مدیریت کند. برای یک برنامه‌نویس متوسط، این یعنی AI حالا می‌تواند کارهای بلندمدت‌تری مثل بهینه‌سازی هسته سیستم‌عامل یا توسعه وب‌های پیچیده را در طیف گسترده‌تری از ابزارها نسبت به گذشته مدیریت کند.

همان‌طور که در تحلیل‌های قبلی ما درباره‌ی امنیت مدل‌های بازمتن اشاره کردیم، گسترش دسترسی به مدل‌های قدرتمند، هم‌زمان چالش‌های جدیدی در کنترل خروجی‌ها ایجاد می‌کند. طبق اعلام GitHub، تست‌های داخلی نشان می‌دهد Grok 4.6 در وظایفی که نیاز به استدلال مستمر و استفاده از ابزارها دارند — به‌ویژه در Copilot CLI و محیط‌های کدنویسی مبتنی بر ترمینال در VS Code — عملکرد خیره‌کننده‌ای داشته است. این موضوع با ادعای xAI هم‌سو است که می‌گوید: «Grok 4.6 بر پایه Grok 4.5 ساخته شده است، اما تمرکز ویژه‌ای بر روی عامل‌های بلندمدت و کارهای تعاملی و بصری بلندپروازانه‌تر دارد.» این رویکرد در راستای رقابت تنگاتنگ Grok 4.6 با GPT-5.6 در کدنویسی پیچیده است که پیش‌تر به جزئیات آن پرداخته بودیم.

به گزارش unite.ai، این مدل برای کاربران پلن‌های Pro، Pro+، Max، Business و Enterprise فعال شده است. برخلاف اکثر مدل‌ها که فقط روی VS Code تمرکز می‌کنند، Grok 4.6 در ۸ محیط مختلف در دسترس است:

  • VS Code و Visual Studio
  • Copilot CLI و Cloud Agent
  • اپلیکیشن Copilot
  • IDEهای JetBrains، Xcode و Eclipse

این توزیع گسترده غیرمعمول است؛ چراکه GitHub با پشتیبانی از JetBrains، Xcode و Eclipse، مدل Grok 4.6 را به دست توسعه‌دهندگانی می‌رساند که کاملاً خارج از هسته VS Code فعالیت می‌کنند، در حالی که اکثر مدل‌های Copilot معمولاً در ابتدا فقط روی VS Code متمرکز می‌شوند.

جزئیات: عملکرد و بنچمارک‌ها

در بخش عملکرد، بنچمارک‌های فنی ارائه شده توسط xAI جایگاه این مدل را در صدر کلاس کدنویسی قرار می‌دهد، هرچند باید توجه داشت که این نتایج بر اساس تست‌های داخلی و محیط‌های انتخابی خود xAI گزارش شده‌اند:

  • هوش عمومی: در شاخص Artificial Analysis (که ترکیبی از ۹ بنچمارک مختلف است)، امتیاز ۶۱ را کسب کرد که با GPT-5.6 Sol Max برابری می‌کند و تنها یک امتیاز با Fable 5 Max (با امتیاز ۶۲) فاصله دارد.
  • کارهای دانشی: در آزمون GDPVal-AA با امتیاز ۱۷۵۳، هر دو رقیب GPT-5.6 Sol Max (۱۷۲۸) و Fable 5 Max (۱۷۴۱) را شکست داد.
  • کدنویسی عامل‌محور: در CursorBench v3.2 به نرخ ۶۹.۹٪ رسید که بالاتر از GPT-5.6 Sol Max (۶۷.۲٪) است، اما با فاصله اندکی از Fable 5 Max (۷۰.۵٪) عقب‌تر است.
  • مهندسی نرم‌افزار: در DeepSWE v1.1 امتیاز ۶۵.۹٪ را گرفت؛ این یک جهش قابل توجه نسبت به نسخه قبلی یعنی Grok 4.5 High (۵۴٪) است، هرچند هنوز از امتیاز ۷۳٪ مدل GPT-5.6 Sol Max فاصله دارد.

دستورالعمل مهندسی

از نظر فنی، SpaceXAI (یا همان xAI) مدل Grok 4.6 را نه به عنوان یک مدل بنیادی جدید، بلکه به عنوان یک ارتقای پس‌آموزشی (Post-training upgrade) معرفی کرد. آن‌ها مدل پایه را ثابت نگه داشتند اما یک دوره آموزشی تکمیلی طولانی‌تر روی داده‌های منتخب استدلالی و مهندسی اجرا کردند.

آن‌ها همچنین از Grok 4.5 برای بازتولید مسیرهای تنظیم نظارت‌شده (SFT) — شبیه به بازبینی پاسخ‌های یک شاگرد توسط یک استاد برای اصلاح مسیر یادگیری — استفاده کردند و یادگیری تقویتی (RL) را روی وظایف عامل‌محور شامل موارد زیر اعمال نمودند:

  • بهینه‌سازی هسته (Kernel optimization)
  • توسعه وب
  • طراحی به کمک کامپیوتر (CAD)

این استراتژی باعث شد عملکرد مدل در محیط ترمینال به‌شدت رشد کند. در Terminal-Bench v3.0، امتیاز Grok 4.6 به ۲۶٪ رسید که تقریباً دو برابر نسخه قبلی (۱۵.۷٪) است، هرچند هنوز با ۳۴.۶٪ مدل GPT-5.6 Sol Max فاصله دارد.

دسترسی و اقتصاد

دسترسی به این مدل برای کاربران سازمانی در ابتدا غیرفعال است و مدیران باید آن را به‌صورت دستی در تنظیمات Copilot فعال کنند تا کاربران بتوانند مدل را انتخاب کنند. علاوه بر این، عرضه مدل به‌صورت تدریجی است؛ GitHub اشاره کرده توسعه‌دهندگانی که هنوز Grok 4.6 را در منوی انتخاب نمی‌بینند، باید منتظر بمانند تا دسترسی در مناطق مختلف گسترش یابد.

سیستم پرداخت بر اساس مدل مصرفی (Usage-based) است و نه سهمیه درخواست‌های ثابت. قیمت‌ها در منوی انتخاب مدل تضاد شدیدی ایجاد کرده است:

  • Grok 4.6: ۲ دلار برای هر میلیون توکن ورودی / ۶ دلار برای هر میلیون توکن خروجی.
  • GPT-5.6 Sol: ۵ دلار برای هر میلیون توکن ورودی / ۳۰ دلار برای هر میلیون توکن خروجی.
  • Claude Opus-class: ۵ دلار برای هر میلیون توکن ورودی / ۲۵ دلار برای هر میلیون توکن خروجی.

این قیمت‌گذاری تهاجمی و توزیع گسترده — که شامل APIهای خود xAI، Cursor، Grok Build و شرکایی مانند OpenRouter, Vercel و Cloudflare می‌شود — نشان‌دهنده استراتژی xAI برای تسخیر سریع بازار سازمانی است. نکته قابل توجه این است که xAI برای هفته اول، میزان استفاده رایگان در Grok Build و Cursor را دو برابر کرد؛ فرصتی که تا ۱۹ اوت ۲۰۲۶ به پایان می‌رسد.

با کاهش شدید هزینه نسبت به سایر مدل‌های پرچم‌دار، xAI مانع ورود شرکت‌ها برای استقرار عامل‌های AI بلندمدت در محیط تولید را از بین برده است. اینکه آیا این مزیت قیمتی می‌تواند شکاف اندک بنچمارک‌ها در برابر Fable 5 Max را جبران کند یا خیر، تعیین خواهد کرد که آیا Grok به انتخاب پیش‌فرض برای مهندسی عامل‌محور تبدیل می‌شود یا خیر. شما باید تنظیمات Copilot خود را بررسی کنید تا ببینید آیا این مدل به منطقه شما رسیده است یا خیر.

گام بعدی شما

  • اگر کاربر Copilot هستید، تنظیمات مدل را بررسی کنید تا ببینید Grok 4.6 به منطقه شما رسیده است یا خیر.
  • برای کارهای مربوط به ترمینال و بهینه‌سازی کد، Grok 4.6 را در برابر GPT-5.6 Sol تست کنید تا تفاوت هزینه و کیفیت را بسنجید.
  • اگر مدیر سیستم هستید، دسترسی به این مدل را برای تیم مهندسی فعال کنید تا هزینه‌های استنتاج ماهانه را کاهش دهید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این حرکت xAI با تکیه بر اعتبار زیرساختی SpaceX، مدل‌های گران‌قیمت OpenAI و Anthropic را در موقعیت دشواری قرار می‌دهد. کاهش هزینه استنتاج باعث می‌شود استقرار عامل‌های خودکار در محیط‌های عملیاتی از یک تجربه گران‌قیمت به یک استاندارد اقتصادی تبدیل شود.

تأثیر برای ایران

به‌دلیل محدودیت‌های API و تحریم‌ها، دسترسی مستقیم به Grok 4.6 برای توسعه‌دهندگان ایرانی دشوار است؛ با این حال، حضور این مدل در ابزارهایی مثل Cursor که مسیرهای دسترسی منعطف‌تری دارند، فرصت استفاده از استنتاج ارزان‌تر را فراهم می‌کند.

·نگاه ما
تحریریه دات‌هوش

جنگ مدل‌های کدنویسی از رقابت روی بنچمارک‌های ایستا به رقابت روی «هزینه استنتاج در مقیاس» تغییر مسیر داده است. xAI با پذیرش عقب‌ماندگی جزئی در برخی معیارها اما ارائه قیمتی بسیار ارزان‌تر، در واقع در حال تبدیل کردن Grok به «گزینه پیش‌فرض» برای شرکت‌هایی است که می‌خواهند هزاران عامل AI را به‌صورت هم‌زمان در خط تولید کد خود فعال کنند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.