پرش به محتوای اصلی
پرش به محتوای مقاله

مدل Grok 4.7 مقاومت در برابر دستورات خطرناک را افزایش داد

·۳۰ شهریور ۱۴۰۵۲ دقیقه مطالعه۲ بازدید
لوگوی Grok 4.7: نسخه جدید مدل زبانی با قابلیت‌های پیشرفته استدلال و کدنویسی
لوگوی Grok 4.7: نسخه جدید مدل زبانی با قابلیت‌های پیشرفته استدلال و کدنویسی
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر هدف از چت عمومی به بهینه‌سازی قیمت-عملکرد برای کارهای طولانی‌مدت و تخصصی؛ همراه با ایجاد یک سقف جدید در ایمنی زیست‌شناختی.

اگر امروز برای پروژه‌های کدنویسی سنگین یا تحلیل‌های تخصصی از هوش مصنوعی استفاده می‌کنید، احتمالاً با محدودیت زمان و دقت مواجه شده‌اید. مدل جدید x.ai دقیقاً برای پر کردن این شکاف طراحی شده است.

طبق اعلام x.ai در ۲۱ سپتامبر ۲۰۲۶، مدل Grok 4.7 توانسته است در محک ایمنی زیست‌شناختی LatchBio به امتیاز ۶۲.۴٪ برسد که یک رکورد جدید در این حوزه است. این مدل برخلاف نسخه‌های قبلی که بیشتر برای گپ‌وگفت‌های عمومی بودند، برای کارهای تخصصی طراحی شده که نیاز به ساعت‌ها محاسبات دارند.

این تحول در حالی رخ می‌دهد که کسب‌وکارها از پرامپت‌های ساده به سمت گردش‌های کاری پیچیده و چندمرحله‌ای می‌روند؛ یعنی شبیه به تحلیل‌گرهای انسانی که هر مرحله را بررسی و اصلاح می‌کنند. همان‌طور که در تحلیل‌های قبلی ما درباره‌ی امنیت مدل‌های زبانی اشاره کردیم، گذار به سمت ابزارهای سازمانی نیازمند حذف رفتارهای پیش‌بینی‌ناپذیر است. این موضوع در حالی اهمیت می‌یابد که برخی مدل‌های پیشرو در کنترل ربات‌ها همچنان در برابر دستورات خطرناک آسیب‌پذیر هستند.

بر اساس مستندات منتشر شده، Grok 4.7 از یک مدل بنیادی (Foundation Model) — شبیه به یک دانشمند همه‌فن‌حریف که تمام کتابخانه‌های جهان را خوانده و حالا زیربنای دانش مدل است — بزرگ‌تر از نسخه ۴.۶ استفاده می‌کند و با دوره‌ای طولانی‌تر از یادگیری تقویتی آموزش دیده است. جزئیات فنی این به‌روزرسانی عبارتند از:

  • عملکرد کدنویسی: دستیابی به سطح پیشرو در نسبت قیمت به عملکرد در محک CursorBench 4.0.
  • کاربرد تخصصی: بهبود نمرات در آزمون‌های GDPval و AA Briefcase برای وظایف حقوقی، پرستاری و مالی.
  • امنیت سایبری: طبق گزارش x.ai، تنها ۳.۳٪ از دستورات خطرناک در HackerBench v0.3 توانسته‌اند از سد حفاظتی مدل بگذرند.
  • قیمت‌گذاری: شروع قیمت از ۲ دلار برای هر میلیون توکن (Token) ورودی و ۶ دلار برای هر میلیون توکن خروجی. این کاهش هزینه‌ها در راستای بهینه‌سازی متدهای استنتاج در مدل‌های زبانی صورت گرفته است تا دسترسی سازمان‌ها به مدل‌های قدرتمند تسهیل شود.

این تغییر مسیر نشان می‌دهد x.ai قصد دارد شخصیت «جسور و تند» نسخه‌های اولیه Grok را کنار بگذارد و به یک ابزار قابل‌اعتماد برای سازمان‌ها تبدیل شود. با اولویت دادن به «خود-راستی‌آزمایی» و لایه‌های حفاظتی سخت‌گیرانه، این مدل اکنون برای صنایع حساس مثل بیوتکنولوژی و امنیت سایبری کاربردی است.

کاربران در حال حاضر می‌توانند از طریق Cursor، Grok Build و API این مدل استفاده کنند.

گام بعدی شما

  • اگر توسعه‌دهنده هستید، عملکرد Grok 4.7 را در محیط Cursor برای توابع پیچیده تست کنید.
  • هزینه‌های استنتاج (Inference) — یعنی همان لحظه تولید جواب توسط مدل — را با مدل‌های رقیب در مقیاس صنعتی مقایسه کنید.
  • دسترسی‌های تیم قرمز (Red Teaming) را دنبال کنید تا ببینید آیا ابزارهای دفاعی جدیدی برای عموم منتشر می‌شود یا خیر.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این به‌روزرسانی با تکیه بر اعتبار محک‌های تخصصی، استانداردهای جدیدی برای ایمنی مدل‌های زبانی در حوزه‌های حساس تعریف می‌کند. شرکت‌هایی که در صنایع بیوتکنولوژی و امنیت فعال‌اند، اکنون جایگزینی قابل‌اعتماد برای مدل‌های بسته دارند.

تأثیر برای ایران

به‌دلیل محدودیت‌های API و تحریم‌ها، دسترسی مستقیم به Grok 4.7 برای توسعه‌دهندگان ایرانی دشوار است و احتمالاً از طریق واسطه‌های شخص ثالث یا ابزارهای Cursor امکان‌پذیر خواهد بود.

·نگاه ما
تحریریه دات‌هوش

تغییر استراتژی x.ai از یک مدل «سرگرم‌کننده» به یک ابزار «سازمانی»، نشان‌دهنده اشباع بازار مدل‌های چت عمومی است. تمرکز بر ایمنی زیست‌شناختی و سایبری، تلاش مستقیم ایلان ماسک برای ورود به بازارهای رگوله شده و حساس است که در آن دقت و امنیت، بر خلاقیت اولویت دارد.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.