پرش به محتوای اصلی
پرش به محتوای مقاله

مطالعهٔ پن استیت: ۸۳٪ دستورات کاربران در فشرده‌سازی حافظهٔ هوش مصنوعی حذف

·۲۷ مرداد ۱۴۰۵۳ دقیقه مطالعه
سیستم‌های هوش مصنوعی در فشرده‌سازی متن، دستورات کاربر را حذف می‌کنند
سیستم‌های هوش مصنوعی در فشرده‌سازی متن، دستورات کاربر را حذف می‌کنند
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

کشف این واقعیت که فشرده‌سازی حافظه به‌طور سیستماتیک «محدودیت‌های رفتاری» را قربانی «تداوم وظیفه» می‌کند و ارائه یک ماژول خارجی (Plug-and-play) برای حل این مشکل بدون نیاز به بازآموزی مدل.

اگر امروز از یک عامل هوش مصنوعی برای مدیریت کارهای حساس استفاده می‌کنید، احتمالاً دستورات «هرگز» و «فقط» شما در طول مسیر حذف می‌شوند. طبق مطالعه‌ای از پژوهشگران دانشگاه پن استیت (Penn State) که در ۱۸ آگوست ۲۰۲۶ منتشر شد، تنها ۱۷ درصد از محدودیت‌های تعیین‌شده توسط کاربر در فرآیند فشرده‌سازی حافظه باقی می‌مانند.

این شکست فنی به این معناست که یک عامل (Agent) — شبیه به کارآموزی که در میان حجم زیاد یادداشت‌ها، دستورات کلیدی رئیسش را فراموش می‌کند — ممکن است دستور صریحی مثل «قبل از اعمال تغییرات تایید بگیر» را صرفاً به دلیل طولانی شدن گفتگو نادیده بگیرد.

بسیاری از کاربران یک پنجرهٔ چت را به عنوان فضای کاری دائمی می‌بینند و حجم عظیمی از داده را در یک جلسه می‌ریزند. برای جلوگیری از کند شدن یا کرش کردن سیستم، آزمایشگاه‌های هوش مصنوعی از «فشرده‌سازی» (Compaction) استفاده می‌کنند؛ فرآیندی که تاریخچه را خلاصه می‌کند تا فضا باز شود. همان‌طور که در تحلیل‌های قبلی ما درباره‌ی امنیت مدل‌های زبانی اشاره کردیم، این بهینه‌سازی‌ها اغلب به قیمت از دست رفتن جزئیات رفتاری تمام می‌شوند. در این حالت، سیستم‌ها وظیفه اصلی را حفظ می‌کنند اما قوانین جانبی را به عنوان نویز دور می‌اندازند.

تصور کنید به دستیار خود گفته‌اید هرگز نام شما را در ایمیل‌ها ننویسد. با پیشرفت چت و فشرده شدن حافظه، این محدودیت خاص اولین چیزی است که حذف می‌شود. نتیجه، یک شکاف امنیتی و کیفی است که در آن عامل‌ها بدون اجازه ابزارها را فراخوانی می‌کنند یا اطلاعات محرمانه را افشا می‌کنند. این چالش‌ها در مدیریت بستر داده‌ها، یادآور تلاش‌هایی است که ابزارهایی مانند ContextForge برای اتوماسیون بستر‌سازی و رفع باگ‌های AI به دنبال حل آن هستند تا دقت مدل‌ها در پروژه‌های پیچیده حفظ شود.

هوش مصنوعی دستور کاربر را هنگام فشرده‌سازی متن نادیده می‌گیرد

پژوهشگران برای اندازه‌گیری این پدیده، مجموعه ارزیابی COMPINT را توسعه دادند. یافته‌های آن‌ها افت شدید قابلیت اطمینان را نشان می‌دهد:

  • پایگاه امتثال: وقتی مدل به متن کامل و فشرده‌نشده دسترسی دارد، رعایت قوانین بین ۵۹٪ تا ۷۱٪ است.
  • پس از فشرده‌سازی: این نرخ به‌شدت سقوط می‌کند و گاهی به سطحی می‌رسد که انگار مدل اصلاً قانونی دریافت نکرده است.
  • عملکرد مدل‌ها: اکثر فشرده‌سازها بدتر از حالت «بدون فشرده‌سازی» عمل کردند، هرچند GPT-5.4-mini در سناریوهای خاصی از خط پایه بهتر بود.

به نقل از این گزارش، حتی پرامپت‌های هدفمند برای حفظ محدودیت‌ها نتوانستند نرخ ماندگاری را به بالای ۴۰٪ برسانند. مشکل از مهندسی پرامپت نیست، بلکه از ساختار بنیادی فشرده‌سازی است که تداوم وظیفه را بر مرزهای رفتاری اولویت می‌دهد. این عدم تداوم در درک دستورات، اغلب منجر به خروجی‌های متناقض می‌شود که برای مقابله با آن‌ها، موتورهای شفاف‌سازی متوالی برای حذف چرخه‌های تکرار طراحی شده‌اند تا بازبینی‌های مکرر کاهش یابد.

تیم پژوهشی برای حل این مشکل، یک ماژول قابل اتصال بر پایه Qwen3.5-9B معرفی کرد. این مدل زبانی کوچک (SLM) — مثل یک ناظر دقیق که کنار حسابدار اصلی می‌نشیند و فقط روی لیست ممنوعیت‌ها تمرکز می‌کند — در کنار سیستم اصلی اجرا می‌شود و هر ورودی را برای یافتن محدودیت‌ها اسکن می‌کند. این لیست محافظت‌شده سپس به خلاصه نهایی اضافه می‌شود تا قوانین در فرآیند فشرده‌سازی زنده بمانند.

این استخراج‌کننده در تمام تست‌ها به نرخ ماندگاری بالای ۹۰٪ رسید؛ از جمله ۹۵.۶٪ برای مسیرهای عامل‌محور و ۹۰.۳٪ برای چت‌های چندمرحله‌ای. از آنجا که این روش نیازی به آموزش مجدد یا تغییر در هسته سیستم ندارد، راهکاری مقیاس‌پذیر برای افزایش قابلیت اطمینان عامل‌هاست.

برای کاربران تجاری، این یعنی «حافظه» فعلی عامل‌های هوش مصنوعی در گردش‌کارهای حساس، یک ریسک است. تا زمانی که ردیابی مجزای محدودیت‌ها به یک استاندارد تبدیل نشود، نمی‌توان به یک عامل اعتماد کرد که دستورات «نباید» را در جلسات طولانی به خاطر بسپارد.

گام بعدی شما

  • در جلسات طولانی با AI، هر چند مرحله یک‌بار دستورات کلیدی و محدودیت‌های امنیتی خود را بازنویسی کنید.
  • اگر توسعه‌دهنده هستید، مجموعه COMPINT را از گیت‌هاب دریافت کرده و خط لوله (Pipeline) خود را تست کنید.
  • برای کارهای حساس، از مدل‌هایی با پنجره متنی (Context Window) بزرگ‌تر استفاده کنید تا نیاز به فشرده‌سازی کاهش یابد.

اما داستان سخت‌افزاری این تحول و فشار روی VRAM حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این مطالعه اعتبار ادعاهای مربوط به «حافظه بلندمدت» در عامل‌های هوش مصنوعی را به چالش می‌کشد. بر اساس تخصص پژوهشگران پن استیت، بدون لایه‌های نظارتی مجزا، استقرار عامل‌ها در محیط‌های سازمانی با ریسک امنیتی بالا غیرممکن است.

تأثیر برای ایران

این پژوهش برای توسعه‌دهندگان ایرانی که در حال ساخت عامل‌های هوش مصنوعی برای اتوماسیون اداری هستند حیاتی است؛ چرا که نشان می‌دهد نباید برای حفظ قوانین امنیتی تنها به حافظه داخلی مدل‌های API متکی بود.

·نگاه ما
تحریریه دات‌هوش

اتکای بیش از حد به خلاصه‌سازی برای مدیریت حافظه، یک نقطه ضعف ساختاری در معماری ترنسفورمرهاست. این یافته نشان می‌دهد که «حافظه» در مدل‌های فعلی، بیشتر شبیه به یک بازنویسی تقریبی است تا یک ذخیره‌سازی دقیق. راهکار استفاده از یک SLM نظارتی، در واقع پذیرش این واقعیت است که یک مدل نمی‌تواند هم‌زمان هم «خلاق» باشد و هم «دقیقاً قانون‌مدار».

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.