پرش به محتوای اصلی
پرش به محتوای مقاله

MAI-Cyber-1-Flash در برابر Gemini و GPT-5.6 در بنچمارک CyberGym

·۶ مرداد ۱۴۰۵۳ دقیقه مطالعه
لوگوی مایکروسافت در کنار نماد سپر امنیت سایبری و عامل هوش مصنوعی
لوگوی مایکروسافت در کنار نماد سپر امنیت سایبری و عامل هوش مصنوعی
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

معماری لایه‌ای در چارچوب MDASH که وظایف را بین یک مدل سریع (Flash) و یک مدل استدلالی (GPT-5.4) تقسیم می‌کند تا هم سرعت و هم دقت در سطح بنچمارک CyberGym به حداکثر برسد.

تصور کنید یک تیم کامل از متخصصان امنیت، در عرض چند دقیقه حفره‌های امنیتی کد شما را پیدا کرده و وصله کنند، بدون اینکه یک خط کد توسط انسان نوشته شده باشد. این رویای اتوماسیون کامل امنیت، اکنون با امتیاز ۹۶٪ در محک CyberGym به واقعیت نزدیک شده است.

طبق گزارش techcrunch.com، مایکروسافت در تاریخ ۲۷ جولای ۲۰۲۶ در سان‌فرانسیسکو از مدل تخصصی MAI-Cyber-1-Flash و پلتفرم Perception پرده برداشت. این ابزارها در زمانی عرضه می‌شوند که هکرها برای مقیاس‌بندی حملات خود، به‌طور گسترده از هوش مصنوعی استفاده می‌کنند. همان‌طور که در تحلیل قبلی ما درباره‌ی کاهش ۵۰ درصدی هزینه‌های امنیتی اشاره کردیم، مایکروسافت اکنون این ابزارها را به محیط عملیاتی می‌برد تا سرعت دفاع سازمان‌ها با سرعت حملات مدرن برابر شود.

مصطفی سلیمان، مدیرعامل هوش مصنوعی مایکروسافت، توضیح داد که این سامانه از یک ساختار لایه‌ای در چارچوب MDASH استفاده می‌کند تا هزینه و عملکرد را بهینه کند:

  • MAI-Cyber-1-Flash: مدلی مقرون‌به‌صرفه که ۹۰٪ کارهای روتین امنیتی را مدیریت می‌کند.
  • GPT-5.4: مدلی بزرگ‌تر و گران‌تر که فقط برای ۱۰٪ آسیب‌پذیری‌های بسیار دشوار رزرو شده است.

پلتفرم Perception از تیم‌های عامل‌محور (Agentic) — شبیه به یک شرکت کوچک که هر کارمندش تخصص متفاوتی دارد و با بقیه هماهنگ است — برای خودکارسازی چرخه امنیت استفاده می‌کند. به جای ساعت‌ها کار دستی، این پلتفرم با سه نقش مجزا عمل می‌کند:

  • تیم‌های قرمز (Red Teams): حملات دقیق را شبیه‌سازی کرده و حفره‌های قابل سوءاستفاده را می‌یابند.
  • تیم‌های آبی (Blue Teams): باگ‌های موجود در کد را شناسایی و اولویت‌بندی می‌کنند.
  • تیم‌های سبز (Green Teams): اقدامات اصلاحی را اجرا کرده و کد نهایی را برای رفع مشکل می‌نویسند.

دیو وستون، مهندس ارشد Perception، خاطرنشان کرد که این روند، تلاش‌های پراکنده دستی را با یک فرآیند یکپارچه جایگزین می‌کند. برای مدیران کسب‌وکار، این یعنی امنیت از یک سرویس وابسته به نیروی انسانی به یک ابزار نرم‌افزاری تبدیل می‌شود. خودکارسازی مرحله «تیم سبز» یعنی نوشتن کد اصلاحی، پنجره خطر را از چندین روز به چند دقیقه کاهش می‌دهد.

این اقدام فشار مستقیمی بر رقبایی مثل Mythos آنتروپیک و Day Break اوپن‌ای‌آی وارد می‌کند. ادغام عمیق این ابزارها با چارچوب MDASH، نشان از حرکت مایکروسافت به سمت یک پشته امنیتی کاملاً خودگردان دارد.

کاربران می‌توانند از ۳ نوامبر ۲۰۲۶ به نسخه پیش‌نمایش این ابزارها دسترسی داشته باشند. اما سؤال کلیدی این است که آیا این تیم‌های عامل‌محور می‌توانند تهدیدات «روز صفر» را بدون نظارت انسان مدیریت کنند؟

گام بعدی شما

  • اگر مدیر فنی هستید، مدل هزینه-به-عملکرد لایه‌ای (Tiered) را برای کاهش هزینه‌های استنتاج در پروژه‌های خود بررسی کنید.
  • جریان‌های کاری تیم قرمز و آبی خود را برای پذیرش خروجی‌های مدل‌های تخصصی آماده کنید.
  • منتظر انتشار نتایج واقعی این مدل در مواجهه با حملات Zero-day در ماه نوامبر باشید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این رویکرد با تکیه بر اعتبار مهندسی مایکروسافت در اکوسیستم سازمانی، سرعت پاسخ به حملات سایبری را از مقیاس روز به دقیقه می‌رساند. این تغییر، مدل کسب‌وکار شرکت‌های امنیتی سنتی را که بر نیروی انسانی متکی هستند، به شدت تهدید می‌کند.

تأثیر برای ایران

به‌دلیل محدودیت‌های API و تحریم‌های مایکروسافت، دسترسی مستقیم به Perception برای سازمان‌های ایرانی دشوار است؛ با این حال، معماری لایه‌ای آن الگویی برای توسعه سامانه‌های امنیتی داخلی است.

·نگاه ما
تحریریه دات‌هوش

جایگزینی کامل «تیم سبز» یا همان مرحله کدنویسی اصلاحی، خطرناک‌ترین و در عین حال جذاب‌ترین بخش این به‌روزرسانی است. مایکروسافت با استراتژی لایه‌بندی مدل‌ها (Flash برای روتین و GPT-5.4 برای پیچیدگی)، عملاً مدل‌های غول‌پیکر را به «متخصص ارشد» و مدل‌های کوچک را به «کارمند اجرایی» تبدیل کرده است تا گلوگاه هزینه استنتاج را از بین ببرد.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.