تصور کنید برنامهنویسی کنید و هر تغییر کوچک در سیستم، نیازمند تایید دستی شما باشد؛ این اصطکاک اکنون به پایان رسیده است. طبق اعلام آنتروپیک (Anthropic)، سیستم طبقهبندی ایمنی در Claude Code اکنون ۸۹٪ از دستورات خطرناک را پیش از اجرا متوقف میکند.
این قابلیت از ۱۴ اوت ۲۰۲۶ برای کاربران طرحهای Pro، Max و Team به صورت پیشفرض فعال میشود. با این تغییر، نقش توسعهدهنده از کدنویسی فعال به نظارت سطح بالا تغییر میکند. همانطور که در پوشش پیشین ما از نحوه حل نشت حافظه در محیطهای عملیاتی توسط Claude Code دیدیم، هدف این بهروزرسانی حذف تاییدات دستی تکراری در هر مرحله از توسعه است.
عاملهای هوش مصنوعی (AI Agents) — شبیه دستیارهای هوشمندی که میتوانند به جای شما ابزارها را اجرا کنند و تصمیم بگیرند — اکنون از رابطهای ساده چت به ابزارهای خودمختاری تبدیل شدهاند که تغییرات سیستمی پیچیده را اعمال میکنند. به نقل از وبلاگ آنتروپیک، این سیستم از یک طبقهبندیکننده استفاده میکند تا تشخیص دهد آیا یک اقدام بازگشتناپذیر یا خطرناک است یا خیر. تنها در موارد پرریسک، سیستم از انسان درخواست تایید میکند.
دادههای فنی این تغییرات کاملاً ملموس است:
- بهرهوری: تیمهای فعال در حالت Auto Mode حدود ۲۵٪ درخواستهای ادغام (Pull Request) بیشتری تولید کردند.
- ایمنی: در مطالعهای با ۱۰۵۳ آزمایشکننده، بازبینهای انسانی تنها ۱۳.۶٪ از دستورات خطرناک را شناسایی کردند، در حالی که Auto Mode به دقت ۸۹٪ رسید.

- امنیت: بررسیهای مستقل Trajectory Labs نشان داد که از ۷۲۰ تلاش برای تزریق پرامپت (Prompt Injection) — شبیه تلاش برای فریب دادن یک نگهبان با دادن دستورات متناقض — هیچکدام در مدلهای Fable 5، Opus 5 و Sonnet 5 موفق نبودند. این نتایج در ادامه رقابت شدید مدلهای خانواده کلود است، جایی که مدل Opus 5 در بنچمارکهای کدنویسی توانست از Fable 5 پیشی بگیرد. در مقابل، مدل GPT-5.6 Sol شرکت OpenAI اجازه داد ۵.۸۳٪ از این حملات عبور کنند.
در محیطهای داخلی، این سیستم پیش از این از آپلود دادههای محرمانه در صفحات عمومی جلوگیری کرده و ۲۰۰۰ فرآیندی را که باعث کرش کردن آموزشهای GPU میشد، متوقف کرده است. این رویکرد امنیتی با استراتژیهای گستردهتر آنتروپیک همسو است که در آن کنترل دادههای سازمانی را برای امنیت بیشتر به سرورهای مشتری منتقل کرد. نکته مهم این است که آنتروپیک هزینهای برای توکنهای مصرفشده توسط خودِ طبقهبندیکننده ایمنی دریافت نمیکند.
این چرخش، پارادوکس خطرناکی برای تیمهای مهندسی ایجاد میکند. هرچه توسعهدهندگان کمتر در جزئیات دخالت کنند، نظارت آنها حیاتیتر میشود، اما در عین حال درک عمیق از کدی که توسط یک عامل خودمختار نوشته شده، سختتر میشود. در واقع، نقش مهندس ارشد در حال تبدیل شدن به یک حسابرس هوش مصنوعی است.
گام بعدی شما
- اگر از Claude Code استفاده میکنید، تنظیمات Auto Mode را بررسی کنید و سطح دسترسیهای مدل را بازبینی نمایید.
- در پروژههای حساس، یک لایه بازبینی انسانی برای تغییرات زیرساختی (Infrastructure) حفظ کنید.
- عملکرد مدلهای خود را در برابر تزریق پرامپت با ابزارهای تست مستقل بسنجید.
اما اثر این خودمختاری بر بدهی فنی (Technical Debt) بلندمدت پروژهها هنوز ناشناخته است — به تحلیل ما درباره مدیریت کد در عصر عاملهای هوشمند مراجعه کنید.




گفتگو