
دستیابی به امنیت کامل در برابر Prompt Injection از طریق مدل منتقد
موتور متنباز PlannerCritic ثابت کرد که محدودیتهای معماری بسیار مؤثرتر از دستورات سیستمی برای توقف تزریق پرامپت هستند. این سیستم با استفاده از گیتهای قطعی و یک مدل منتقد مجزا،…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۲ مقاله منتشر شده

موتور متنباز PlannerCritic ثابت کرد که محدودیتهای معماری بسیار مؤثرتر از دستورات سیستمی برای توقف تزریق پرامپت هستند. این سیستم با استفاده از گیتهای قطعی و یک مدل منتقد مجزا،…

یک برنامهنویس چارچوبی ساختاریافته برای مهندسی پرامپت در Claude معرفی کرده که منجر به بازگشت ۱۰ ساعت بهرهوری در هفته شده است. این متد با جایگزینی پرسشهای مبهم با درخواستهای با…

مدلهای خانواده GPT-5.6 اکنون در محیط توسعه spec-driven شرکت AWS با نام Kiro در دسترس هستند. نتایج تستهای مشترک نشان میدهد رویکرد «نیازمند-محور» در کدنویسی، هزینههای عملیاتی را…

عاملهای هوش مصنوعی بهدلیل پدیده «لغزش زمینه»، دستورات اولیه را با رشد تاریخچه گفتگو فراموش میکنند. معماری جدید با انتقال حافظه به ذخیرهسازهای معنایی و مدیریت خودکار وضعیت، این…

پژوهشی جدید نشان میدهد عاملهای هوش مصنوعی هنگام مواجهه با کمبود داده، بهجای پذیرش نادانی، اطلاعاتی باورپذیر اما ساختگی تولید میکنند. این «بدهی انسجام» باعث میشود ابزارهای…

کودکان با کسری از دادههای مورد نیاز مدلهای زبانی بزرگ، تسلط بر زبان را به دست میآورند. پژوهشگران اکنون با مدلهای «مقیاس نوزاد» و دوربینهای سرپوشی در تلاشاند تا مکانیسم…

یک معماری جدید پیشنهاد میدهد که شکست عاملهای هوش مصنوعی نه به دلیل ضعف در استدلال، بلکه به دلیل تصمیمگیری دربارهی «چه چیزی پرسیده شود» است. با انتقال لیست نیازمندیها به خارج…

آزمونهای مقایسهای روی بارهای کاری عاملمحور نشان میدهد GPT-5.6 Terra در پایداری فراخوانی ابزارها بهطور قابلتوجهی از Claude Sonnet 4.5 پیشی گرفته است. اگرچه کلود سریعتر و…

مدل حاکمیتی FROST با معرفی یک «قانون اساسی» ششلایه، مانع از انحراف هدف و جعل داده در عاملهای هوشمند میشود. این سیستم با جداسازی مدیریت از حاکمیت، تضمین میکند که عاملها در…

مصاحبه با ۲۰ مهندس هوش مصنوعی نشان میدهد که اکثر استقرارهای عاملمحور بهدلیل اشتباه در تعریف «عامل» و تکیه بر تعویض مدل بهجای طراحی سیستمی شکست میخورند. تفاوت میان یک رابط چت…

محک جدید ThoughtDAG نشان میدهد حذف یک پیام اشتباه از تاریخچهٔ گفتگو، لزوماً اثر آن خطا را از حافظهٔ مدل پاک نمیکند. «پژواک» این اشتباهات در پاسخهای بعدی باقی میماند، مگر آنکه…

مدلهای چندوجهی از خطلولههای ساده به سمت «تلفیق میانی» حرکت میکنند تا تصاویر را بهجای شرح متنی، بهعنوان توکنهای بومی پردازش کنند. این معماری نرخ توهم را کاهش داده و استدلال…