اگر امروز برای ابزارهای کدنویسی AI هزینه پرداخت میکنید، احتمالاً بهزودی با گزینهای مواجه میشوید که هم ارزانتر است و هم در محیطهای متنوعتری کار میکند. مدل Grok 4.6 تنها دو روز پس از عرضه رسمی در ۱۲ اوت ۲۰۲۶، از ۱۴ اوت ۲۰۲۶ در GitHub Copilot فعال شد تا به ابزاری کلیدی برای جریانهای کاری عاملمحور (Agentic) تبدیل شود. این مدل اکنون از طریق منوی انتخاب مدل (Model Picker) قابل دسترسی است و xAI با این اقدام، جدیدترین پرچمدار خود را به عنوان ابزاری اصلی برای استدلالهای بلندمدت و گردشهای کاری خودکار معرفی کرده است.
زمینه: گذار به کدنویسی عاملمحور
دنیای دستیارهای کدنویسی در حال گذار از تکمیل خودکار ساده به سمت عاملهای هوش مصنوعی (AI Agents) است؛ یعنی سیستمهایی شبیه به یک کارآموز خبره که میتواند بدون نیاز به نظارت لحظهای، چندین مرحله از یک پروژه پیچیده را بهتنهایی پیش ببرد و بدون گم کردن مسیر (Drifting)، وظایف چندمرحلهای را مدیریت کند. برای یک برنامهنویس متوسط، این یعنی AI حالا میتواند کارهای بلندمدتتری مثل بهینهسازی هسته سیستمعامل یا توسعه وبهای پیچیده را در طیف گستردهتری از ابزارها نسبت به گذشته مدیریت کند.
همانطور که در تحلیلهای قبلی ما دربارهی امنیت مدلهای بازمتن اشاره کردیم، گسترش دسترسی به مدلهای قدرتمند، همزمان چالشهای جدیدی در کنترل خروجیها ایجاد میکند. طبق اعلام GitHub، تستهای داخلی نشان میدهد Grok 4.6 در وظایفی که نیاز به استدلال مستمر و استفاده از ابزارها دارند — بهویژه در Copilot CLI و محیطهای کدنویسی مبتنی بر ترمینال در VS Code — عملکرد خیرهکنندهای داشته است. این موضوع با ادعای xAI همسو است که میگوید: «Grok 4.6 بر پایه Grok 4.5 ساخته شده است، اما تمرکز ویژهای بر روی عاملهای بلندمدت و کارهای تعاملی و بصری بلندپروازانهتر دارد.» این رویکرد در راستای رقابت تنگاتنگ Grok 4.6 با GPT-5.6 در کدنویسی پیچیده است که پیشتر به جزئیات آن پرداخته بودیم.
به گزارش unite.ai، این مدل برای کاربران پلنهای Pro، Pro+، Max، Business و Enterprise فعال شده است. برخلاف اکثر مدلها که فقط روی VS Code تمرکز میکنند، Grok 4.6 در ۸ محیط مختلف در دسترس است:
- VS Code و Visual Studio
- Copilot CLI و Cloud Agent
- اپلیکیشن Copilot
- IDEهای JetBrains، Xcode و Eclipse
این توزیع گسترده غیرمعمول است؛ چراکه GitHub با پشتیبانی از JetBrains، Xcode و Eclipse، مدل Grok 4.6 را به دست توسعهدهندگانی میرساند که کاملاً خارج از هسته VS Code فعالیت میکنند، در حالی که اکثر مدلهای Copilot معمولاً در ابتدا فقط روی VS Code متمرکز میشوند.
جزئیات: عملکرد و بنچمارکها
در بخش عملکرد، بنچمارکهای فنی ارائه شده توسط xAI جایگاه این مدل را در صدر کلاس کدنویسی قرار میدهد، هرچند باید توجه داشت که این نتایج بر اساس تستهای داخلی و محیطهای انتخابی خود xAI گزارش شدهاند:
- هوش عمومی: در شاخص Artificial Analysis (که ترکیبی از ۹ بنچمارک مختلف است)، امتیاز ۶۱ را کسب کرد که با GPT-5.6 Sol Max برابری میکند و تنها یک امتیاز با Fable 5 Max (با امتیاز ۶۲) فاصله دارد.
- کارهای دانشی: در آزمون GDPVal-AA با امتیاز ۱۷۵۳، هر دو رقیب GPT-5.6 Sol Max (۱۷۲۸) و Fable 5 Max (۱۷۴۱) را شکست داد.
- کدنویسی عاملمحور: در CursorBench v3.2 به نرخ ۶۹.۹٪ رسید که بالاتر از GPT-5.6 Sol Max (۶۷.۲٪) است، اما با فاصله اندکی از Fable 5 Max (۷۰.۵٪) عقبتر است.
- مهندسی نرمافزار: در DeepSWE v1.1 امتیاز ۶۵.۹٪ را گرفت؛ این یک جهش قابل توجه نسبت به نسخه قبلی یعنی Grok 4.5 High (۵۴٪) است، هرچند هنوز از امتیاز ۷۳٪ مدل GPT-5.6 Sol Max فاصله دارد.
دستورالعمل مهندسی
از نظر فنی، SpaceXAI (یا همان xAI) مدل Grok 4.6 را نه به عنوان یک مدل بنیادی جدید، بلکه به عنوان یک ارتقای پسآموزشی (Post-training upgrade) معرفی کرد. آنها مدل پایه را ثابت نگه داشتند اما یک دوره آموزشی تکمیلی طولانیتر روی دادههای منتخب استدلالی و مهندسی اجرا کردند.
آنها همچنین از Grok 4.5 برای بازتولید مسیرهای تنظیم نظارتشده (SFT) — شبیه به بازبینی پاسخهای یک شاگرد توسط یک استاد برای اصلاح مسیر یادگیری — استفاده کردند و یادگیری تقویتی (RL) را روی وظایف عاملمحور شامل موارد زیر اعمال نمودند:
- بهینهسازی هسته (Kernel optimization)
- توسعه وب
- طراحی به کمک کامپیوتر (CAD)
این استراتژی باعث شد عملکرد مدل در محیط ترمینال بهشدت رشد کند. در Terminal-Bench v3.0، امتیاز Grok 4.6 به ۲۶٪ رسید که تقریباً دو برابر نسخه قبلی (۱۵.۷٪) است، هرچند هنوز با ۳۴.۶٪ مدل GPT-5.6 Sol Max فاصله دارد.
دسترسی و اقتصاد
دسترسی به این مدل برای کاربران سازمانی در ابتدا غیرفعال است و مدیران باید آن را بهصورت دستی در تنظیمات Copilot فعال کنند تا کاربران بتوانند مدل را انتخاب کنند. علاوه بر این، عرضه مدل بهصورت تدریجی است؛ GitHub اشاره کرده توسعهدهندگانی که هنوز Grok 4.6 را در منوی انتخاب نمیبینند، باید منتظر بمانند تا دسترسی در مناطق مختلف گسترش یابد.
سیستم پرداخت بر اساس مدل مصرفی (Usage-based) است و نه سهمیه درخواستهای ثابت. قیمتها در منوی انتخاب مدل تضاد شدیدی ایجاد کرده است:
- Grok 4.6: ۲ دلار برای هر میلیون توکن ورودی / ۶ دلار برای هر میلیون توکن خروجی.
- GPT-5.6 Sol: ۵ دلار برای هر میلیون توکن ورودی / ۳۰ دلار برای هر میلیون توکن خروجی.
- Claude Opus-class: ۵ دلار برای هر میلیون توکن ورودی / ۲۵ دلار برای هر میلیون توکن خروجی.
این قیمتگذاری تهاجمی و توزیع گسترده — که شامل APIهای خود xAI، Cursor، Grok Build و شرکایی مانند OpenRouter, Vercel و Cloudflare میشود — نشاندهنده استراتژی xAI برای تسخیر سریع بازار سازمانی است. نکته قابل توجه این است که xAI برای هفته اول، میزان استفاده رایگان در Grok Build و Cursor را دو برابر کرد؛ فرصتی که تا ۱۹ اوت ۲۰۲۶ به پایان میرسد.
با کاهش شدید هزینه نسبت به سایر مدلهای پرچمدار، xAI مانع ورود شرکتها برای استقرار عاملهای AI بلندمدت در محیط تولید را از بین برده است. اینکه آیا این مزیت قیمتی میتواند شکاف اندک بنچمارکها در برابر Fable 5 Max را جبران کند یا خیر، تعیین خواهد کرد که آیا Grok به انتخاب پیشفرض برای مهندسی عاملمحور تبدیل میشود یا خیر. شما باید تنظیمات Copilot خود را بررسی کنید تا ببینید آیا این مدل به منطقه شما رسیده است یا خیر.
گام بعدی شما
- اگر کاربر Copilot هستید، تنظیمات مدل را بررسی کنید تا ببینید Grok 4.6 به منطقه شما رسیده است یا خیر.
- برای کارهای مربوط به ترمینال و بهینهسازی کد، Grok 4.6 را در برابر GPT-5.6 Sol تست کنید تا تفاوت هزینه و کیفیت را بسنجید.
- اگر مدیر سیستم هستید، دسترسی به این مدل را برای تیم مهندسی فعال کنید تا هزینههای استنتاج ماهانه را کاهش دهید.
اما داستان سختافزاری این تحول حتی شگفتانگیزتر است — به تحلیل ما دربارهی تراشههای Blackwell مراجعه کنید.




گفتگو