پرش به محتوای اصلی
پرش به محتوای مقاله

گزارش AISI: مدل Claude Mythos تمام شبیه‌سازی‌های حملات سایبری را پشت سر گذاشت

·۲۶ اردیبهشت ۱۴۰۵۳ دقیقه مطالعه
گزارش AISI: مدل Claude Mythos تمام شبیه‌سازی‌های حملات سایبری را پشت سر گذاشت
اشتراک‌گذاری

اگر مدیر امنیت اطلاعات هستید، باید بدانید که قواعد بازی تغییر کرده است. Claude Mythos Preview نخستین مدلی است که تمام شبیه‌سازی‌های حملات سایبری مؤسسه امنیت هوش مصنوعی بریتانیا (AISI) را با موفقیت پشت سر گذاشت.

این پیشرفت در حالی رخ می‌دهد که توانایی‌های سایبری هوش مصنوعی هر ۴.۷ ماه دو برابر می‌شود. این سرعت بسیار بیشتر از تخمین ۸ ماهه در نوامبر ۲۰۲۵ است. همان‌طور که در تحلیل قبلی ما درباره‌ی تغییرات قیمت‌گذاری API شرکت Anthropic اشاره کردیم، این جهش عملکردی بهای سنگینی دارد.

طبق گزارش AISI، این مدل در شبیه‌سازی کنترل صنعتی «برج خنک‌کننده» در ۳ مورد از ۱۰ تلاش موفق بود؛ دستاوردی که هیچ مدل دیگری به آن نرسیده است. در یک حمله ۳۲ مرحله‌ای به شبکه شرکتی، Mythos Preview در ۶ مورد از ۱۰ تلاش پیروز شد، در حالی که نسخه‌های قبلی تنها ۳ مورد را پاس کرده بودند.

Line chart showing AISI cybersecurity time horizons on a log scale. The x-axis shows model release dates from early 2025 to late 2026, the y-axis shows 80% reliability time horizons ranging from 6 minutes to 4 days. Two trend lines illustrate previous estimates: a gray dashed line for the November 2025 estimate of roughly 8-month doubling, and a red dashed line for the pre-Mythos frontier trend of roughly 4.7-month doubling. Older models like o1 and Claude 3.7 Sonnet cluster near the bottom left. The newest models - Mythos Preview and GPT-5.5 - break sharply upward from both trend lines, with wide uncertainty distributions indicating they have saturated the test suite.

بر اساس بررسی‌های مستقل شرکت XBOW، این مدل نرخ «منفی کاذب» (False Negatives) را در مقایسه با Opus 4.6 تا ۴۲٪ کاهش داده است. اگر مدل به کد منبع دسترسی کامل داشته باشد، این کاهش به ۵۵٪ می‌رسد. این مدل به‌ویژه در یافتن نقاط ضعف در محیط ایزوله‌ی (Sandbox) موتور V8 مرورگر کرومیوم بی‌رقیب بود.

Bar chart comparing AI models on vulnerability detection odds. The y-axis shows the ratio of successful finds to misses, scaled from 0 to 12.5. Mythos Preview (Anthropic) leads with a score near 11, far ahead of GPT-5.5 (OpenAI) at roughly 7.5. Earlier models including Opus 4.5, Opus 4.6, Gemini 3.1 Pro, and GPT-5.4 trail significantly, scoring between 2 and 5.

اما دقت بالا هزینه دارد. Anthropic اعلام کرد که هزینه استنتاج (Inference) — که مثل خودِ آشپزی است، نه دوره‌ی آموزش آشپز — در این مدل ممکن است ۵ برابر مدل Opus باشد. به همین دلیل، بسیاری احتمالاً از عامل‌های مبتنی بر GPT-5.5 استفاده کنند که نتایج مشابهی را با قیمت کمتر ارائه می‌دهند.

این وضعیت یک شکاف ژئوپلیتیک ایجاد کرده است؛ چراکه آمریکا دسترسی چین و اتحادیه اروپا را محدود می‌کند، در حالی که OpenAI در حال هماهنگی برای دسترسی زودهنگام شرکای اروپایی است.

گام بعدی شما

  • معیارهای سخت‌گیرانه‌تری که AISI در حال طراحی است را دنبال کنید.
  • بررسی کنید آیا ارائه‌دهندگان دیگر مدل‌های بدون محدودیت امنیتی با قابلیت‌های مشابه منتشر می‌کنند یا خیر.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این گزارش با تکیه بر اعتبار AISI ثابت می‌کند که مدل‌های زبانی اکنون قادر به شناسایی خودکار آسیب‌پذیری‌های پیچیده هستند. این موضوع تعادل قدرت بین متخصصان امنیت و ابزارهای خودکار را به‌کلی تغییر می‌دهد.

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

موضوع‌ها

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.