اگر همین حالا در حال استقرار عاملهای هوش مصنوعی در محیط عملیاتی هستید، باید بدانید که دیوارهای امنیتی سنتی دیگر پاسخگو نیستند. تزریق پرامپت (Prompt Injection) بهسادگی از قوانین ایستا عبور میکند و تنها راه نجات، پذیرش این فرض است که هر ورودی، بالقوه مخرب است.
سامانه Trust Gateway مفهوم زودهنگام «دیوار آتش هوش مصنوعی» را با یک خط لوله ۱۲ مرحلهای جایگزین کرده است که در هر مرحله، امکان رد درخواست بهصورت مستقل وجود دارد. طبق گزارشی که در ۲۳ اوت ۲۰۲۶ در وبسایت dev.to منتشر شد، این چرخش راهبردی، تمرکز را از فیلترینگ ساده به یک لایه قرنطینه سختگیرانه برای تعاملات عاملمحور (Agentic) تغییر میدهد. این رویکرد در پاسخ به چالشهای شناسایی سریع آسیبپذیریهاست، مشابه آنچه در کشف ۹۱ حفره امنیتی توسط NexaVerify مشاهده شد که سرعت تشخیص ماشین را برتری بخشید.
همانطور که در تحلیلهای پیشین ما درباره امنیت مدلهای بازمتن اشاره کردیم، ایجاد مرزهای سخت دور مدلها معمولاً شکست میخورد. Trust Gateway هر ورودی را مانند یک بسته مشکوک در پست میبیند — شبیه به دستگاههای اسکنر فرودگاه که هر لایه را جداگانه بررسی میکنند تا هیچ شیء ممنوعهای به منطقه امن نرسد — و پیش از رسیدن دادهها به منطق اصلی، یکپارچگی آنها را میسنجد.
مشخصات فنی
- خط لوله اعتبارسنجی: فرآیندی ۱۲ مرحلهای شامل مرحله SCHEMA (مرحله ۰۳) برای شناسایی تزریق پرامپت و مرحله PROVENANCE (مرحله ۰۸) برای بررسی منشأ دادهها.
- تست استواری: این سیستم ۴۰۰ تکرار Fuzzing (تست با دادههای تصادفی) شامل جابهجایی بایتها و تغییر بیتهای امضا را پشت سر گذاشت و هیچ کرشی (Crash) رخ نداد.
- ناورداهای ریاضی: ۲۳ تست مبتنی بر ویژگی با ۲۰۰ تکرار برای هر کدام، تعیینگر بودن و تکرارپذیری JCS را تأیید میکنند.
- اتصال مصنوعات: اعتبارنامههای ATC v3 اکنون شامل git_commit_sha و docker_digest هستند تا اصالت کد و محیط اجرا تضمین شود. این تکامل در استانداردهای احراز هویت، در ادامه مشخصات ATC/1.0 به عنوان نخستین استاندارد باز برای کارتهای اعتماد عاملها صورت گرفته است.
بر اساس مستندات فنی، این سامانه در حال حاضر آرگومانهای فراخوانی ابزار را پیش از اجرا بررسی میکند، اما فیلتری برای نتایج پس از اجرا ندارد. این یعنی «مسمومسازی زمان اجرا» از طریق خروجی ابزارها همچنان یک حفره امنیتی واقعی است. نسخه بعدی قصد دارد خروجی ابزارها را نیز بهعنوان دادههای غیرقابلاعتماد تلقی کند؛ درست مانند روشی که اکنون اجرای دستورات خطرناک شل (مانند rm -rf) یا خواندن فایلهای حساس .env را مسدود میکند. برای مقابله با چنین خطاهای عملیاتی، برخی راهکارها بر ثبت سوابق روی زنجیره (Blockchain) متمرکز شدهاند تا هر اقدام عامل قابل ردیابی و بازبینی باشد.
انتقال از مدلهای ATT&CK به نگاشتهای MITRE ATLAS — بهویژه تطبیق ۱۰ تکنیک ATLAS با کاهشدهندههای UTA — نشاندهنده حرفهای شدن امنیت هوش مصنوعی است. این تغییر، صنعت را از بازی «موش و گربه» در هک پرامپتها به سمت یک مدل تهدید رسمی بر اساس بردارهای حمله خاص هوش مصنوعی میبرد.
گام بعدی شما
- اگر از عاملهای خودکار استفاده میکنید، بررسی کنید که آیا لایهای برای اعتبارسنجی SCHEMA در ورودیها دارید یا خیر.
- انتشار نسخه جدید Trust Gateway را دنبال کنید تا ببینید آیا حفره مسمومسازی خروجی ابزارها بسته میشود یا نه.
- استانداردهای MITRE ATLAS را جایگزین متدهای سنتی امنیت شبکه در معماری عاملهای خود کنید.
اما داستان سختافزاری این تحول حتی شگفتانگیزتر است — به تحلیل ما درباره تراشههای Blackwell مراجعه کنید.




گفتگو