تصور کنید یک کارمند داخلی، کلیدهای حساس API شرکت را در یک بحث دوستانه درباره ویژگیهای React به یک همکار میفرستد و هیچ سیستم امنیتی متوجه این سرقت نمیشود. این کابوس امنیتی اکنون با ابزاری به نام conversation-steganography در گیتهاب به واقعیت تبدیل شده است.
طبق گزارشهای منتشر شده در ۲۰ جولای ۲۰۲۶، این ابزار ثابت کرد که میتوان دادههای رمزنگاریشده را چنان در دل گفتگوهای هوش مصنوعی جای داد که حتی سختگیرانهترین فیلترهای نظارت بر محتوا (Content Moderation) را بدون اثر رد شود. این تکنیک در واقع همان استگانوگرافی (Steganography) یا هنر پنهاننگاری است — شبیه به اینکه کسی پیامی مخفی را در حاشیه یک تابلو نقاشی بکشد تا کسی متوجه نشود — اما این بار بهجای پیکسلهای عکس، از کلمات در مدل زبانی بزرگ (LLM) — که مثل کتابخانهداری است با میلیاردها صفحه آشناست و با همان لحن جواب میدهد — استفاده میکند.
همانطور که در تحلیلهای پیشین ما درباره امنیت مدلهای بازمتن اشاره کردیم، اعتماد به «ظاهر» متن در عصر هوش مصنوعی یک ریسک است. در دنیایی که سازمانها برای مراقبت از دادهها به ابزارهای جلوگیری از نشت دادهها (DLP) تکیه میکنند، تبدیل یک محموله دزدی به یک گپ ساده درباره «کامپوننتهای سرور»، یک نقطه کور بحرانی ایجاد میکند. در همین راستا، رویکرد ماسکگذاری محلی اطلاعات حساس (PII) به عنوان یکی از راهکارهای پیشگیرانه برای جلوگیری از خروج ناخواسته دادهها در چتهای AI مطرح شده است.
به نقل از گزارش dev.to، این ابزار برای رسیدن به نامرئیشدن کامل از یک سازوکار چهارلایه استفاده میکند:
- تولید متناسب با زمینه: استفاده از مدل زبانی برای خلق متن پوششی که کاملاً شبیه گفتگوهای انسانی است.
- رمزگذاری در سطح نویسه: تغییرات بسیار ظریف در انتخاب کلمات، حامل دادههای رمزنگاریشده هستند.
- رمزنگاری کلید-محور: بدون داشتن کلید مخفی، دادهها دقیقاً شبیه نویزهای تصادفی به نظر میرسند.
- نامرئیبودن آماری: خروجیها از آزمونهای تحلیل فرکانس خی-دو (Chi-squared) عبور میکنند تا «رباتیک» به نظر نرسند.
بر اساس مستندات فنی، این فرآیند با توابع encode و decode یک کتابخانه استگانوگرافی اجرا میشود. برای مثال، کاربر پیامی را با یک کلید مخفی رمز میکند تا متنی تولید شود که شبیه یک چت عادی با AI است. گیرنده نیز با اجرای تابع رمزگشایی و کلید متناظر، پیام اصلی را باز مییابد. به دلیل آنتروپی بالای زبان طبیعی، این پیامها از نظر آماری تفاوتی با متنهای عادی ندارند (p-value > 0.05).
در تستهای عملی، این ابزار در ۵ سناریوی مختلف موفقیت ۱۰۰ درصدی در دور زدن تشخیصها داشت:
- تاریخچه چتها (Chat logs)
- متن ایمیلها
- توضیحات کدها (Code comments)
- پستهای انجمنها
- شبکههای اجتماعی
این یافتهها پروفایل ریسک استقرار هوش مصنوعی در شرکتها را تغییر میدهد. فیلترهای مبتنی بر کلمات کلیدی دیگر در برابر این حملات کارایی ندارند. پیامدهای امنیتی این موضوع شامل خروج دادهها توسط عوامل داخلی، ارتباطات مخفی مهاجمان در کانالهای تحت نظارت و حتی مسمومسازی دادههای آموزشی با دستورات پنهان است.
این وضعیت هر رابط کاربری چت AI را به یک تونل احتمالی برای جاسوسی تبدیل میکند. اگر مهاجم برای هر پیام از یک کلید یکبار مصرف استفاده کند، شناسایی این ارتباط از نظر ریاضی غیرممکن میشود.
گام بعدی شما
- تغییر استراتژی نظارتی از «اسکن تکپیامها» به «پایش الگوهای رفتاری» در طول زمان.
- محدود کردن شدید دسترسی به دادههای حساس در محیطهایی که ابزارهای چت AI فعال هستند.
- دنبال کردن ابزارهای متنباز جدیدی که برای شناسایی ناهنجاریهای آماری در متن طراحی شدهاند.
اما این تنها لایه اول است؛ اثر این تکنیک بر امنیت زنجیره تأمین نرمافزار را در گزارش بعدی بررسی خواهیم کرد.




گفتگو