پرش به محتوای اصلی
پرش به محتوای مقاله

چگونه احراز هویت سه‌سطحی، محدودیت‌های Claude 5.5 را برای تحلیلگران برمی‌دارد؟

·۱۵ مهر ۱۴۰۵۶ دقیقه مطالعه
برنامه تأیید امنیت سایبری Anthropic با سه سطح دسترسی گسترش یافت
برنامه تأیید امنیت سایبری Anthropic با سه سطح دسترسی گسترش یافت
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

جایگزینی فیلترهای متنی (Guardrails) با سیستم احراز هویت سازمانی؛ حالا دسترسی به قابلیت‌های تهاجمی مدل‌ها نه با ترفندهای پرامپت، بلکه با تاییدیه رسمی سازمان‌ها ممکن است.

اگر یک متخصص امنیت هستید که با محدودیت‌های سخت‌گیرانه مدل‌های زبانی در تحلیل بدافزارها دست‌وپنجه نرم می‌کنید، قوانین بازی تغییر کرده است. آنتروپیک حالا اجازه می‌دهد کاربران تأییدشده، حفاظ‌های امنیتی مدل‌های خود را دور بزنند تا قدرت واقعی هوش مصنوعی در عملیات سایبری آزاد شود.

به نقل از اعلام رسمی آنتروپیک (Anthropic) در ۶ اکتبر ۲۰۲۶، این شرکت برنامه گسترش‌یافته‌ی «احراز هویت سایبری» (CVP) را معرفی کرد. این سیستم یک ساختار سه‌لایه ایجاد می‌کند که به متخصصان امنیت دسترسی به ابزارهای سطح بالا می‌دهد. تمام این لایه‌ها شامل دسترسی به مدل‌های Claude Opus 5.5، Claude Sonnet 5.5، Claude Mythos 5.1 و مدل‌های آتی است. این به‌روزرسانی در حالی رخ می‌دهد که کلاود اپوس ۵.۵ پیش از این توانسته است هزینه‌های استنتاج را در بارهای کاری رایج تا ۴۰٪ کاهش دهد و بهره‌وری عملیاتی را افزایش دهد.

این تصمیم برای حل چالش «کاربرد دوگانه» در امنیت سایبری اتخاذ شده است. آنتروپیک امنیت سایبری را ذاتاً دارای کاربرد دوگانه توصیف کرد و بیان داشت همان قابلیت‌هایی که به یک تیم امنیتی اجازه می‌دهد آسیب‌پذیری را پیدا کرده و برطرف کند، می‌تواند به یک بازیگر مخرب برای بهره‌برداری از آن حفره کمک کند. مدل زبانی بزرگ (LLM) — مثل کتابخانه‌داری که میلیاردها صفحه را خوانده و حالا با همان لحن کتاب‌ها جواب می‌دهد — در دنیای امنیت مانند یک چاقوی دو لبه است. به همین دلیل، آنتروپیک برای کاربران عادی حفاظ‌های سخت‌گیرانه‌ای روی مدل‌های عمومی خود، از جمله Claude Opus 5.5، Claude Sonnet 5.5 و Claude Fable 5.1 قرار داده است تا اکثر وظایف مرتبط با سایبری برای عموم مردم مسدود شود. هدف از این رویکرد، محدود کردن فعالیت‌های مضر توسط مهاجمان است، در حالی که شرکت هم‌زمان روی کاهش «مثبت‌های کاذب» (False Positives) برای کدنویسی امن کار می‌کند.

همان‌طور که در تحلیل قبلی ما درباره‌ی حمایت‌های آنتروپیک از استارتاپ‌ها اشاره کردیم، این برنامه حالا تمرکز را به سمت دنیای پرمخاطره‌ی امنیت زیرساخت‌ها می‌برد. این چارچوب جدید، دو ابتکار قبلی را با هم ادغام کرده است: «پروژه گلس‌وینگ» (Project Glasswing) که به سازمان‌های متولی امنیت نرم‌افزارهای حیاتی دسترسی به Claude Mythos را می‌داد، و نسخه اولیه CVP که به تیم‌های امنیتی تأییدشده، حفاظ‌های کاهش‌یافته‌ای را روی مدل‌های Claude Opus و Claude Sonnet ارائه می‌کرد. در حالی که کاربران عادی هنوز می‌توانند کارهای ساده‌ای مثل بررسی‌های اولیه کد، وصله کردن مسائل شناخته‌شده، یافتن آسیب‌پذیری در کدهای منبع متعلق به خودشان و اولویت‌بندی هشدارهای امنیتی را انجام دهند، لایه‌های جدید قابلیت‌های عمیق‌تری را باز می‌کنند.

لایه‌های سه‌گانه دسترسی

  • دسترسی تدافعی (Defense Access): این لایه برای کارهای دفاعی طراحی شده است؛ از جمله وظایف مرکز عملیات امنیت (SOC)، پاسخ به حوادث (Incident Response)، مهندسی معکوس بدافزارها و تحلیل و اعتبارسنجی آسیب‌پذیری‌ها. این لایه برای تیم‌های امنیتی در شرکت‌ها، سازمان‌های غیرانتفاعی، دانشگاه‌ها و نهادهای دولتی که از سیستم‌های خودشان دفاع می‌کنند، باز است. همچنین اپراتورهای زیرساخت‌های حیاتی در هر اندازه (مانند خدمات شهری یا بیمارستان‌های منطقه‌ای)، شرکت‌های امنیتی کوچک‌تر، نگهدارندگان پروژه‌های متن‌باز و پژوهشگران انفرادی که سابقه گزارش آسیب‌پذیری دارند، واجد شرایط هستند. آنتروپیک انتظار دارد بسیاری از سازمان‌های دفاعی واجد شرایط باشند و هدفش پاسخ به درخواست‌ها در عرض چند روز است.
  • دسترسی تیم قرمز (Red Team Access): این لایه قابلیت‌های تست نفوذ مجاز و عملیات تیم قرمز را علیه سیستم‌هایی که سازمان اجازه تست آن‌ها را دارد (از جمله سیستم‌های IT در صنایع حیاتی) اضافه می‌کند. دسترسی به این بخش محدود به سازمان‌هایی مانند تیم‌های قرمز داخلی، تیم‌های قرمز دولتی یا شرکت‌های تخصصی تست نفوذ و امنیت است. با این حال، کاربران همچنان با مسدودسازی‌های لحظه‌ای در برابر اقداماتی که می‌تواند باعث اختلال گسترده یا آسیب فیزیکی شود، روبرو هستند؛ اقداماتی مثل تخریب سیستم‌های فیزیکی، استقرار باج‌افزار یا تست نفوذ در سیستم‌های ایمنی با ریسک بالا. بررسی این درخواست‌ها چند هفته زمان می‌برد و متقاضیان تا زمان تأیید نهایی، در لایه «دسترسی تدافعی» ثبت می‌شوند.
  • دسترسی تخصصی (Specialized Access): بازترین و سهل‌گیرترین لایه است که برای مجموعه محدودی از سازمان‌های تأییدشده رزرو شده است. این سازمان‌ها مجاز به تست سیستم‌های ایمنی هستند که می‌تواند بر جان انسان‌ها اثر بگذارد یا بازارها را مختل کند. نمونه‌هایی از این زیرساخت‌ها شامل شبکه‌های مخابراتی، شبکه‌های برق، سیستم‌های عملیاتی پرواز، شبکه‌های اداری دولتی و زیرساخت‌های انتقال بین‌بانکی است. آنتروپیک این متقاضیان را با بررسی‌های عمیق و در همکاری با دولت ایالات متحده ارزیابی می‌کند. اعضای فعلی پروژه گلس‌وینگ بدون نیاز به تأیید مجدد برای مدل‌های فعلی، به این لایه منتقل می‌شوند. این رویکرد لایه‌بندی‌شده برای دسترسی‌های حساس، مشابه استراتژی شرکت در برنامه‌ی دسترسی سازمان‌های علوم زیستی به مدل‌های پرخطر است که برای مدیریت ریسک‌های بیولوژیکی طراحی شده بود.

جزئیات ثبت‌نام و صلاحیت

طبق مستندات مرکز کمک Claude، افراد حقیقی فقط می‌توانند برای «دسترسی تدافعی» درخواست دهند و باید حتماً دارای یک طرح اشتراکی پولی باشند. لایه‌های «تیم قرمز» و «تخصصی» فقط برای سازمان‌ها باز است. هر سازمان یک درخواست واحد ثبت می‌کند و آنتروپیک متقاضی را در بالاترین لایه‌ای که اطلاعات ارسالی پشتیبانی کند، قرار می‌دهد. هدف شرکت این است که ظرف هفت روز کاری، تصمیم نهایی را اعلام کند یا درخواست اطلاعات بیشتر دهد.

عوامل تعیین صلاحیت عبارت‌اند از:

  • ماهیت کار سازمان و اینکه این کار در نهایت برای چه کسی انجام می‌شود.
  • توانایی آنتروپیک در تأیید هویت سازمان.
  • محیط قانونی و مقرراتی محل فعالیت سازمان.
  • ریسک دسترسی اجباری (توسط دولت‌ها) یا انحراف کاربرد ابزار.
  • رویکرد محتاطانه‌تر و سخت‌گیرانه‌تر برای سازمان‌هایی که عمدتاً به مشتریان نظامی، اطلاعاتی یا مجریان قانون خدمات می‌دهند. این سخت‌گیری‌ها در راستای توسعه‌ی Claude for Government برای ورود به سازمان‌های غیرنظامی آمریکا صورت می‌گیرد تا استانداردهای امنیتی دولتی پاسخی دقیق به نیازهای ملی داشته باشند.

تست عملکرد و حفاظ‌ها

برای اثبات کارایی سیستم، آنتروپیک مدل Claude Opus 5.5 را با استفاده از CyScenarioBench تست کرد. این یک محک (Benchmark) است که اندازه‌گیری می‌کند آیا مدل‌ها می‌توانند عملیات‌های سایبری چندمرحله‌ای را تحت محدودیت‌های واقعی برنامه‌ریزی و اجرا کنند. تست‌ها شامل ۵ تلاش برای هر یک از ۱۰ چالش در هر لایه دسترسی بود. نتایج تفاوت فاحشی را در قابلیت‌ها بر اساس سطح دسترسی نشان داد:

  • بدون دسترسی CVP: ۱۰۰٪ تسک‌ها در همان اولین پرامپت مسدود شدند.
  • دسترسی تدافعی: ۴۶ مورد از ۵۰ تلاش در مقاطعی مسدود شدند و تنها ۴ مورد با موفقیت به پایان رسید.
  • دسترسی تیم قرمز: هیچ مسدودی رخ نداد و مدل ۳۴ مورد از ۵۰ تسک را با موفقیت انجام داد. این نرخ موفقیت ۶۸٪، عملاً معادل با نرخ موفقیت ۶۷.۶٪ مدل در ارزیابی‌هایی است که هیچ حفاظی روی آن اعمال نشده بود؛ نتیجه‌ای که آنتروپیک می‌گوید نماینده عملکرد لایه «دسترسی تخصصی» است.

اثرات واقعی پروژه گلس‌وینگ

داده‌های شش ماه گذشته نشان می‌دهد که هوش مصنوعی چقدر در کشف آسیب‌پذیری‌ها مؤثر است. بین آوریل و ژوئیه ۲۰۲۶، شرکای گلس‌وینگ حداقل ۱۲۹,۰۰۰ آسیب‌پذیری نرم‌افزاری تأییدشده را پیدا کردند. همچنین اسکن‌های متن‌باز خود آنتروپیک بین آوریل و اکتبر ۲۰۲۶، ۵,۵۰۰ مورد دیگر از مسائل تأییدشده را شناسایی کرد.

بیش از ۳۳,۰۰۰ مورد از این‌ها در سطح «بحرانی» (Critical) یا «شدید» (High-severity) بودند. آنتروپیک اشاره می‌کند که این اعداد احتمالاً کمتر از واقعیت هستند، زیرا تنها بر اساس داده‌های نظرسنجی از ۳۳ گزارش شرکا است و انتظار می‌رود تأثیر واقعی حداقل ۵ برابر بیشتر باشد. علاوه بر این، نرخ وصله کردن (Patch rate) نیز به شدت کمتر از واقعیت گزارش شده است، زیرا کمتر از ۵۰٪ شرکا تعداد وصله‌های اعمال شده را افشا کردند، چرا که بسیاری از اصلاحات هنوز در جریان بوده‌اند.

برخی شرکا گزارش داده‌اند که استفاده از مدل‌های Claude Mythos سرعت یافتن آسیب‌پذیری‌ها را از چند ماه یا حتی چند سال، به زمان‌های بسیار کوتاه‌تر رسانده است. این افزایش بهره‌وری در گزارش‌های منتشر شده از شرکایی مانند Comcast و Booz Allen برجسته شده است.

استقرار و حریم خصوصی داده‌ها

سرویس CVP در حال حاضر روی پلتفرم Claude، Vertex AI گوگل و Microsoft Foundry در دسترس است. دسترسی در Amazon Bedrock فعلاً محدود به مشتریانی است که واجد شرایط «حفاظ‌های پیشرو سازمانی» (Enterprise Frontier Safeguards) هستند، زیرا Bedrock هنوز از بررسی انسانی پرچم‌های امنیتی خودکار (که CVP به طور پیش‌فرض به آن نیاز دارد) پشتیبانی نمی‌کند. آنتروپیک در تلاش برای گسترش CVP به تمام مشتریان Bedrock است. ابزارهای کدنویسی شخص ثالث نیز فقط از لایه‌های تدافعی و تیم قرمز پشتیبانی می‌کنند و لایه تخصصی از طریق آن‌ها در دسترس نیست.

ذخیره داده‌ها برای کاربران CVP اجباری است تا آنتروپیک بتواند سوءاستفاده‌ها را نظارت کند. با این حال، از پاییز ۲۰۲۶، راهکار «حفاظ‌های پیشرو سازمانی» — که حفاظ‌های قدرتمند را با حریم خصوصی «عدم ذخیره‌سازی داده‌ها» (Zero Data Retention) ترکیب می‌کند — به سازمان‌های واجد شرایط اجازه می‌دهد داده‌ها را در زیرساخت ابری تحت کنترل خود ذخیره کنند. تا آن زمان، سازمان‌هایی که دسترسی Zero-data-retention به Claude Fable 5.1 یا Claude Mythos 5.1 دارند، می‌توانند از CVP با همین قابلیت استفاده کنند.

الزامات امنیتی نیز بسیار سخت‌گیرانه است. سازمان‌های لایه تدافعی تا ۱۵ دسامبر ۲۰۲۶ فرصت دارند تا احراز هویت چندعاملی (MFA) مقاوم در برابر فیشینگ را پیاده کنند و استفاده از API Key را متوقف کنند. تا آن زمان، داشتن نوعی از MFA الزامی است و کلیدهای API هر هفت روز یک‌بار منقضی می‌شوند. دسترسی به Mythos در ارائه‌دهندگان ابری شخص ثالث معمولاً حدود پنج روز کاری پس از تأیید درخواست فعال می‌شود.

این رویکرد لایه‌بندی‌شده نشان می‌دهد که آزمایشگاه‌های AI دیگر به جای یک کلید ساده «امن/ناامن»، به سراغ سلسله‌مراتب مبتنی بر اعتماد رفته‌اند. این مدل به آزمایشگاه اجازه می‌دهد از دفاع زیرساخت‌های حیاتی حمایت کند بدون اینکه یک سلاح سایبری قدرتمند را در اختیار عموم مردم قرار دهد.

برای صنعت امنیت، این یعنی مانع استفاده از مدل‌های زبانی برای تست‌های پیچیده تیم قرمز، دیگر «مهندسی پرامپت» نیست، بلکه «اعتبارسنجی سازمانی» است. اثر ثانویه این اتفاق احتمالاً موجی از کشف آسیب‌پذیری‌های جدید خواهد بود، زیرا تیم‌های تأییدشده بیشتری به سری مدل‌های Mythos و Opus 5.5 دسترسی پیدا می‌کنند.

سازمان‌هایی که قبلاً در پروژه گلس‌وینگ یا CVP ثبت‌نام کرده بودند، نیازی به درخواست مجدد ندارند و به لایه مربوطه برای مدل‌های Claude Opus 5.5، Claude Sonnet 5.5 و Claude Mythos 5.1 منتقل می‌شوند. سیاست‌های استفاده (Usage Policy) آنتروپیک به طور کامل اعمال می‌شود و شرکت می‌تواند دسترسی‌ها را بررسی، محدود یا لغو کند. ساخت محصولات مشتری‌محور بر اساس این قابلیت‌ها تحت یک «سیاست محصول‌سازی سایبری» (Cyber Productization Policy) مجزا است که درخواست‌های مربوط به آن برای کاربران CVP در دسترس خواهد بود.

برای مشاهده عملکرد زنده این طبقه‌بندی‌ها در محیط‌های واقعی، وبینار ۱۴ اکتبر ۲۰۲۶ را در ساعت ۹ صبح به وقت پاسیفیک دنبال کنید.

گام بعدی شما

  • اگر در سازمان امنیتی فعالیت می‌کنید، مدارک احراز هویت خود را برای درخواست لایه Defense آماده کنید.
  • برای تیم‌های توسعه، بررسی کنید که آیا ابزارهای کدنویسی شما از لایه‌های CVP پشتیبانی می‌کنند یا خیر.
  • وبینار ۱۴ اکتبر ۲۰۲۶ را برای مشاهده عملکرد زنده این مدل‌ها در محیط‌های واقعی دنبال کنید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این مدل دسترسی، استانداردی جدید برای مدیریت ابزارهای «دو منظوره» در صنعت AI ایجاد می‌کند که تخصص سازمان را جایگزین مهندسی پرامپت می‌کند. با این اعتباربخشی، احتمالاً موج جدیدی از کشف آسیب‌پذیری‌های بحرانی در زیرساخت‌های جهانی رخ خواهد داد.

تأثیر برای ایران

به‌دلیل تحریم‌ها و محدودیت‌های API، دسترسی به این لایه‌های تخصصی برای سازمان‌های ایرانی عملاً غیرممکن است و این ابزارها تنها در دسترس نهادهای تاییدشده در غرب قرار دارند.

·نگاه ما
تحریریه دات‌هوش

آنتروپیک با این اقدام، مدل «دموکراتیزه کردن» ابزارهای خطرناک را کنار گذاشت و به جای آن، یک سیستم «کاست» یا طبقاتی بر اساس اعتماد ایجاد کرد. این یعنی دسترسی به قدرت واقعی مدل‌های استدلالی دیگر در اختیار هر کسی که پرامپت‌های پیچیده بنویسد نیست، بلکه به تاییدیه سازمانی گره خورده است. این چرخش نشان می‌دهد که شرکت‌های AI ترجیح می‌دهند کنترل را در سطح زیرساختی حفظ کنند تا اینکه بخواهند با فیلترهای متنی، جلوی کاربران حرفه‌ای را بگیرند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.