تصور کنید یک عامل هوشمند کدنویسی در حال دسترسی به محیط سرور شماست، اما بهجای trusting blind یا اعتماد کور به توسعهدهنده، هر حرکت او توسط یک نگهبان سختگیر بازرسی میشود. اگر امروز از عاملهای autonomous برای توسعه نرمافزار استفاده میکنید، Railward مدل امنیتی شما را از «به من اعتماد کنید» به «من را تأیید کنید» تغییر میدهد.
این ابزار که در ۱۹ ژوئیه ۲۰۲۶ عرضه شد، از یک دروازهی امنیتی fail-closed استفاده میکند؛ یعنی هر عملی که صراحتاً در سیاستهای تعریفشده اجازه داده نشده باشد، بهصورت پیشفرض مسدود میشود. طبق مستندات این پروژه، در این معماری یک تابع خالص (pure function) تصمیم میگیرد که آیا اقدام پیشنهادی عامل اجازه دارد، باید رد شود یا نیاز به پرسوجوی بیشتر دارد.
بسیاری از لایههای ایمنی هوش مصنوعی مانند فیلترهای افزودنی عمل میکنند که بهسادگی دور زده میشوند. اما Railward با عامل را بهعنوان یک موجود غیرقابلاعتماد میبیند. همانطور که در بحثهای گذشتهی ما دربارهی امنیت مدلهای بازمتن اشاره کردیم، حذف نقاط ضعف در لایه تصمیمگیری حیاتی است؛ در اینجا اگر قانونی فعال شود، مدل هرگز به نقطهی تصمیم نهایی دسترسی نخواهد داشت.

به گزارش توسعهدهنده این ابزار در وبسایت dev.to، نقطه قوت این سامانه در «تیم قرمز» یا Adversary داخلی آن است. این سیستم شامل ۴۱ دستور خطرناک است که ابزار موظف است همگی را مسدود کند. همچنین برای هر بار اجرا، یک گواه Ed25519 با زنجیره هش تولید میشود تا هر شخص ثالث بتواند فایل proof.json را بدون نیاز به آپلود داده، از طریق یک تاییدکننده مبتنی بر مرورگر بررسی کند.
مشخصات فنی این ابزار عبارتند از:
- پیادهسازی کامل با پایتون خالص (Pure Python) و کمترین وابستگیها.
- قابلیت اجرای آفلاین روی سختافزار محلی.
- سازگاری به عنوان پلاگین Claude Code از طریق بازار Ourbando.
- قابلیت گسترش لیست دستورات خطرناک از طریق PRهای تکخطی.
این رویکرد پذیرش میکند که هیچ دروازهی نرمافزاری تضمین کامل نیست، اما داشتن یک رکورد امضاشده از شکست، بسیار مفیدتر از یک نشت دادهی خاموش است. این یعنی فضای مبهم میانافزارهای سازمانی AI اکنون جای خود را به شفافیت ریاضی میدهد.
گام بعدی شما
- ابزار را از طریق pip نصب کنید و مجموعه حملات (attack suite) را اجرا کنید تا اولین گواه امنیتی خود را تولید کنید.
- مخزن گیتهاب پروژه را دنبال کنید تا ببینید چه کلاسهای جدیدی از دستورات خطرناک به لیست Adversary اضافه میشوند.
- اگر از Claude Code استفاده میکنید، پلاگین Railward را برای کنترل دسترسیهای عامل تست کنید.
اما داستان سختافزاری اجرای این لایههای امنیتی در لبه، حتی پیچیدهتر است — به تحلیل ما دربارهی رایانش لبه (Edge Computing) مراجعه کنید.




گفتگو