اگر تصور میکنید با کپی کردن کل کد پروژه در یک مدل زبانی میتوانید حفرههای امنیتی را پیدا کنید، احتمالاً ساعتها وقت خود را تلف خواهید کرد. طبق گزارشی که در ۸ سپتامبر ۲۰۲۶ در وبسایت dev.to منتشر شد، این میانبر معمولاً فهرستی از یافتههای متقاعدکننده تولید میکند که در مرحلهی تأیید، بهدلیل ارجاع به کدهای پاکسازیشده یا کلاسهای آسیبپذیری غیرممکن، فرو میپاشند. این موضوع در راستای بررسی حفرههای امنیتی در کدهای تولیدشده توسط AI است که نشان میدهد تکیه مطلق به هوش مصنوعی در کدنویسی میتواند ریسکهای جدیدی ایجاد کند.
این شکست بهدلیل ناتوانی مدل زبانی بزرگ (LLM) — مثل کتابخانهداری که میلیاردها صفحه را خوانده و حالا با همان لحن کتابها جواب میدهد — در نگه داشتن هزاران خط منطق متقاطع در حافظه فعال است. همانطور که در بحثهای گذشتهی ما دربارهی توهمات مدلهای زبانی اشاره کردیم، این ابزارها بهجای استدلال دربارهی جریان واقعی دادهها، بر تطبیق الگوها با کدهای آسیبپذیر در دادههای آموزشی خود تکیه میکنند. نتیجه این است که یک «شکاف توهم» ایجاد میشود؛ خروجی کاملاً حرفهای به نظر میرسد اما ریشهای در منطق خاص آن مخزن کد ندارد. برای حل این چالشهای حافظه و استدلال، راهکارهایی نظیر استفاده از Datalog برای جلوگیری از فراموشی حقایق در عاملهای هوش مصنوعی در حال بررسی است.
برای جلوگیری از این خطا، متخصصان باید یک گردشکار محدودشده را جایگزین کنند:
- شناسایی دستی در ابتدا: استفاده از ابزارهایی مثل Grep برای یافتن فرمتهای رشتهای SQL، فراخوانیهای subprocess یا رندرینگهای نامطمئن.
- تأیید هدفمند: دادن تنها یک تابع و فراخوانندهی آن به مدل، همراه با پرسشی دقیق درباره اینکه آیا ورودی کاربر بدون پاکسازی به کوئری میرسد یا خیر.
- آزمون فرضیه: هر پاسخ مثبت هوش مصنوعی باید بهعنوان یک فرضیه تلقی شود که باید بهصورت دستی ردیابی شود، نه بهعنوان یک یافته نهایی برای گزارش.
این تغییر رویکرد، هوش مصنوعی را از یک اسکنر خودکار معیوب به یک دستیار سریع برای بازبینی کد تبدیل میکند. با محدود کردن پنجره متنی (Context Window) — که شبیه میز کاری است که فقط جای چند ورق دارد، نه کل کتابخانه — به یک مسیر فراخوانی خاص، پاسخهای مدل قابلبررسی و عملی میشوند.
به باور تحلیلگران امنیتی، هوش مصنوعی جایگزین چشم تیزبین ممیز نمیشود، بلکه سرعت تأیید سرنخهایی را که ممیز پیشتر شناسایی کرده، افزایش میدهد. تکیه بر مدل برای مرحلهی کشف اولیه همچنان استراتژی پرریسکی است که اغلب زمانبرتر از خواندن مستقیم کد است. این ناتوانی در تحلیلهای پیچیده، مشابه مواردی است که در آن عاملهای کدنویس پیشرفته در آزمونهای سختافزاری شکست خوردند و نشان دادند که هنوز در مواجهه با محیطهای واقعی محدودیتهای جدی دارند.
گام بعدی شما
- بهجای پرامپتهای کلی، توابع حساس را بهصورت تکهتکه و با تمرکز بر جریان داده به مدل بدهید.
- از ابزارهای جستوجوی متنی برای یافتن الگوهای خطرناک استفاده کنید و سپس از AI برای تحلیل منطق آن تکه کد بخواهید.
- برای یادگیری متدهای پیشرفتهتر، گردشکارهای تیم قرمز را در کتاب AI for Penetration Testing بررسی کنید.
اما داستان سختافزاری این تحول حتی شگفتانگیزتر است — به تحلیل ما دربارهی تراشههای Blackwell مراجعه کنید.




گفتگو