اگر امروز یک ایدهٔ خام برای محصول دارید، Grok 4.6 میتواند آن را بدون نیاز به نظارت لحظهای شما به یک نسخهٔ اولیه و کاربردی تبدیل کند. این مدل دیگر فقط یک چتبات نیست، بلکه ابزاری است که میتواند مسیرهای طولانی اجرای پروژه را مدیریت کند.
طبق گزارش x.ai در ۱۲ اوت ۲۰۲۶، مدل Grok 4.6 در شاخص هوش مصنوعی Artificial Analysis — که ترکیبی از ۹ محک مختلف است — توانسته است با GPT-5.6 Sol برابری کند. این دستاورد در حالی رخ میدهد که صنعت از رابطهای سادهٔ چت به سمت عاملهای هوش مصنوعی (AI Agents) — شبیه به کارمندی که نه تنها میداند چه بگوید، بلکه میتواند ابزارها را برای انجام یک پروژه کامل به کار بگیرد — حرکت میکند. این تحول در راستای استراتژی xAI برای استقرار نیروی کار دیجیتال بر روی رایانههای ابری است تا قابلیتهای عملیاتی مدلها افزایش یابد.
همانطور که در تحلیلهای قبلی ما دربارهی تکامل مدلهای استدلالی اشاره کردیم، چالش اصلی همواره «گم کردن رشتهٔ بحث» در پروژههای چندمرحلهای بود. xAI این نسخه را بهگونهای طراحی کرده است که بتواند چرخهٔ عاملمحور (Agentic) — یعنی تحقیق، ساختاردهی و اصلاح خروجیها — را بدون پرامپتهای مکرر انسانی مدیریت کند.
تکامل فنی
Grok 4.6 نسبت به نسخه ۴.۵، دورهٔ آموزش تکمیلی طولانیتری را پشت سر گذاشته است. تیم توسعه برای بهبود استدلال، از دادههای تولیدشده توسط خودِ مدل و دادههای مهندسی با کیفیت بالا، در کنار یک بهینهساز (Optimizer) — ابزاری که مثل یک مربی سختگیر، خطاهای مدل را در هر مرحله کم میکند — استفاده کرده است.
بر اساس مستندات فنی، نقاط عطف این مدل عبارتاند از:
- بازتولید مسیرهای تنظیم نظارتشده (SFT) در حوزههای STEM و مهندسی نرمافزار توسط Grok 4.5.
- آموزش یادگیری تقویتی (RL) در محیطهای تخصصی برای بهینهسازی هسته (Kernel) و طراحی CAD.
- استفاده از بررسیهای مدلمحور برای حذف ردپاهای مشکلدار در مرحلهٔ SFT.
استقرار و قیمتگذاری
این مدل از امروز در Cursor و Grok Build در دسترس است و در هفتهٔ اول، دو برابر سهمیهٔ معمول به کاربران اختصاص مییابد. همچنین توسعهدهندگان میتوانند از طریق API و شرکایی مثل OpenRouter، Vercel و Cloudflare به آن دسترسی داشته باشند.
هزینهٔ استنتاج (Inference) — لحظهای که مدل واقعاً جواب تولید میکند، شبیه به خودِ آشپزی و نه دورهی آموزش آشپز — برای هر میلیون توکن ورودی ۲ دلار و برای خروجی ۶ دلار تعیین شده است. همچنین یک نسخهٔ «سریع» با هزینهٔ دو برابر در دسترس است.
گام بعدی شما
- اگر توسعهدهنده هستید، Grok 4.6 را در Cursor برای مدیریت مهاجرتهای پیچیدهٔ کد (Codebase Migration) تست کنید.
- تفاوت خروجیهای نسخهٔ استاندارد و «سریع» را از نظر دقت استدلال بسنجید تا متوجه شوید آیا پرداخت هزینهٔ مضاعف منطقی است یا خیر.
- قابلیتهای خودکارسازی end-to-end این مدل را در پروژههای نمونهٔ کوچک به چالش بکشید.
اما اثر این رقابت بر قیمتهای کلی بازار استنتاج حتی جذابتر است — به تحلیل ما دربارهی جنگ قیمتهای توکن در سال ۲۰۲۶ مراجعه کنید.




گفتگو