اگر برای مدیریت بارهای کاری سازمانی در AWS به دنبال مدلهایی با قدرت استدلال بالا هستید، حالا گزینه جدیدی روی میز است. Grok 4.6 با قابلیتهای پیشرفته استدلالی، مسیر ورود به زیرساختهای ابری شرکتهای بزرگ را باز کرد.
به گزارش Unite.AI، این مدل در ۱۹ اوت ۲۰۲۶ بهصورت عمومی در Amazon Bedrock عرضه شد. این مدل اکنون یک گزینه جدید با استدلال بالا (high-reasoning) را برای بارهای کاری هوش مصنوعی سازمانی در AWS فراهم میکند. این حرکت بخشی از یک روند گستردهتر است که در آن مدلهای پیشرو برای دسترسی به مشتریان شرکتی، با اکوسیستمهای ابری ادغام میشوند. همانطور که در پوشش پیشین ما دربارهی افزودن جستوجوی وب داخلی برای مدلهای GPT-5 در Bedrock دیدیم، افزودن Grok 4.6 باعث میشود پرچمدار xAI در محیطهای امنیتی و انطباقی قرار گیرد؛ یعنی همان جایی که بسیاری از شرکتها در حال حاضر دادههای خود را مدیریت میکنند. AWS این افزودن مدل را حول محور امنیت سازمانی، نظارت و استنتاج بینمنطقهای (cross-Region inference) تعریف کرده است.
این تغییر را شبیه جابهجایی یک ابزار تخصصی از یک کارگاه کوچک به یک شبکه توزیع جهانی بدانید. در حالی که نسخه Grok 4.3 پیشین تنها به یک منطقه محدود شده بود، Grok 4.6 اکنون از طریق نقطه اتصال bedrock-runtime در بیش از ۳۰ منطقه AWS قابل دسترسی است.
بستر استقرار و تغییرات راهبردی
این دومین مدل xAI است که به کاتالوگ Bedrock میپیوندد. نسخه قبلی، یعنی Grok 4.3، در ۱۷ ژوئن ۲۰۲۶ به این سرویس اضافه شده بود. آن نسخه قدیمی منحصراً از طریق نقطه اتصال mantle ارائه میشد و دارای یک پنجره متنی (Context Window) بزرگتر به اندازه یک میلیون توکن بود.
اما جهش به Grok 4.6 نشاندهنده یک تغییر در استراتژی است. در حالی که پنجره متنی به ۵۰۰,۰۰۰ توکن (Token) — تکههای کوچکی از متن که مدل تکهتکه میخورد — کاهش یافته و قیمتها افزایش یافته است، اما این مدل اکنون از سیستم استنتاج بینمنطقهای Bedrock پشتیبانی میکند. این سیستم، روش اصلی است که شرکتهای فعال در AWS برای مسیریابی بارهای کاری در محیط تولید (production) از آن استفاده میکنند.
مشخصات فنی و هزینهها
این مدل با شناسه xai.grok-4.6 ثبت شده و ورودیهای متنی و تصویری را میپذیرد، اما خروجیهای آن فقط به صورت متنی است. این تمرکز بر ورودیهای چندوجهی در حالی رخ میدهد که xAI پیشتر استانداردهای بصری خود را با معرفی حالت Quality ارتقا داده بود تا کیفیت تولید تصاویر را به سطح جدیدی برساند. جزئیات فنی و قیمتگذاری عبارتند از:
- پنجره متنی: ۵۰۰,۰۰۰ توکن.
- تنظیمات استدلال: چهار سطح قابل تنظیم: low، medium، high و سطح جدید xhigh.
- قیمت مستقیم: ۲ دلار برای هر میلیون توکن ورودی / ۶ دلار برای هر میلیون توکن خروجی.
- قیمت در Bedrock: ۲.۲۰ / ۶.۶۰ دلار برای هر میلیون توکن در درخواستهای منطقهای (In-Region) و Geo cross-Region؛ و ۲.۰۰ / ۶.۰۰ دلار از طریق استنتاج بینمنطقهای جهانی (Global cross-Region).
- کشینگ: هزینه خواندن از حافظه موقت (Cached-read) برای درخواستهای منطقهای و Geo برابر با ۰.۵۵ دلار و برای استنتاج بینمنطقهای جهانی ۰.۵۰ دلار به ازای هر میلیون توکن است.
بنچمارکها و عملکرد
طبق اعلام xAI، قابلیتهای عاملمحور (Agentic) — یعنی توانایی مدل برای برنامهریزی و اجرای مستقل وظایف — رشد چشمگیری داشته است. در شاخص هوش مصنوعی Artificial Analysis (که ترکیبی از ۹ بنچمارک مختلف است)، مدل Grok 4.6 High امتیاز ۶۱ را کسب کرد و از امتیاز ۵۶ در نسخه Grok 4.5 High پیشی گرفت. این عدد مدل را در سطح GPT-5.6 Sol Max قرار میدهد و تنها یک امتیاز با Fable 5 Max (با امتیاز ۶۲) فاصله دارد.
بیشترین پیشرفتهای گزارششده توسط فروشنده در حوزههای کدنویسی و مجموعههای عاملمحور دیده میشود. مدل به نتایج زیر دست یافت:
- DeepSWE v1.1: رسیدن به ۶۵.۹٪ (افزایش از ۵۴٪).
- APEX-Agents: رسیدن به ۵۷.۵٪ (افزایش از ۴۷.۱٪).
- Terminal-Bench v3.0: رسیدن به ۲۶٪ (افزایش از ۱۵.۷٪).
xAI اشاره میکند که امتیازات شخص ثالث در جدول ارزیابی آنها، نشاندهنده بهترین نتایج خود-گزارششده یا نتایج موجود در فضای عمومی است.
دستور پخت آموزش
برای رسیدن به این اعداد، xAI یک دوره آموزش تکمیلی طولانیتر را روی دادههای مهندسی و استدلالیِ منتخب (که توسط خود مدل تولید شده بود) با تنظیم دقیق نظارتشده (Supervised Fine-tuning) ترکیب کرد. این فرآیند شامل مسیرهایی (trajectories) بود که توسط Grok 4.5 در تلاشهای استدلالی مختلف و چارچوبهای عاملی بازتولید شده بودند.
مرحله نهایی شامل یادگیری تقویتی (Reinforcement Learning) روی وظایف عاملمحور در چندین حوزه تخصصی بود:
- کارهای دانشی و کدنویسی عمومی
- بهینهسازی کرنل (Kernel optimization)
- توسعه وب
- طراحی کامپیوتری (CAD)
نکات استقرار برای توسعهدهندگان
توسعهدهندگان میتوانند از طریق SDK شرکت OpenAI (که به یک URL پایه Bedrock اشاره میکند) یا از طریق AWS Converse API در نقطه اتصال runtime به مدل دسترسی یابند. استدلال بهصورت پیشفرض روی تنظیم low فعال است. در کارت مدل ذکر شده است که محتوای استدلالی رمزگذاریشده میتواند بازگردانده شود و در گفتگوهای چندمرحلهای (multi-turn) دوباره به مدل پاس داده شود.
پشتیبانی از ویژگیها بسته به نقطه اتصال متفاوت است:
- bedrock-runtime: از طریق پروفایلهای استنتاج بینمنطقهای Geo و Global قابل دسترسی است؛ اما از ابزارهای سمت سرور (server-side tool use) پشتیبانی نمیکند.
- bedrock-mantle: مدل را بهصورت منطقهای از us-west-2 (اورگان) ارائه میدهد؛ از فراخوانی ابزار در سمت کلاینت (client-side tool calling) و تشخیص سوءاستفاده (abuse detection) پشتیبانی میکند.
- مشترک: قابلیت کشینگ پرامپت (Prompt caching) در هر دو نقطه اتصال کار میکند.
برای کاربر تجاری، این بهروزرسانی یک موازنه است. Grok 4.6 گرانتر است و نیمی از پنجره متنی Grok 4.3 را دارد (که ۱ میلیون توکن داشت و قیمت آن ۱.۲۵ / ۲.۵۰ دلار بود)، اما عمق استدلال بالاتر و دسترسی منطقهای بهمراتب بهتری برای بارهای کاری تولیدی فراهم میکند.
این تغییر نشان میدهد xAI «تراکم هوش» و دسترسی سازمانی را بر اندازه خام پنجره متنی ترجیح داده است. با ادغام در استنتاج بینمنطقهای Bedrock، xAI در حال تبدیل کردن Grok به یک ستون فقرات قابل اتکا برای عاملهای طولانیمدت در محیطهای شرکتی است.
باید منتظر ماند و دید این سطوح استدلال در گردشکارهای عاملی واقعی چگونه عمل میکنند، بهویژه در محیطهای GitHub Copilot و Cursor؛ جایی که این مدل ابتدا در ۱۲ اوت ۲۰۲۶ عرضه شد و دو روز بعد به هشت سطح توسعه GitHub Copilot گسترش یافت.




گفتگو