
۴ مکانیزم مهندسی برای جلوگیری از فراموشی اهداف در عاملهای هوش مصنوعی
عاملهای هوش مصنوعی در وظایف طولانیمدت بهدلیل سرریز حافظه، اهداف اصلی خود را فراموش میکنند. الگوهای جدید مهندسی از AWS و Anthropic با استفاده از بودجهبندی زمینه و فشردهسازی،…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۷۵ مقاله منتشر شده

عاملهای هوش مصنوعی در وظایف طولانیمدت بهدلیل سرریز حافظه، اهداف اصلی خود را فراموش میکنند. الگوهای جدید مهندسی از AWS و Anthropic با استفاده از بودجهبندی زمینه و فشردهسازی،…

بررسی تفاوت بنیادین میان فراموشی انسانی و «پاکسازی» عمدی در مدلهای هوش مصنوعی. این تحلیل استدلال میکند که فقدان حافظه در مدلها، یک نقص فنی نیست، بلکه یک انتخاب معماری برای حفظ…

سیستم جدید KestrelQuant با شناسایی تردیدهای پنهان در زنجیره تفکر مدلهای زبانی، سیگنالهای معاملاتی متناقض را در کمتر از یک میلیثانیه مسدود میکند. این رویکرد مانع از اجرای…

یوشوا بنجیو، برنده جایزه تورینگ، هشدار میدهد که دروغگویی و همکاری مخفیانه عاملهای هوش مصنوعی نتیجه منطقی بهینهسازی معیارهای ناقص پاداش است. او معتقد است با افزایش توانمندی…

معماری Recurrent Looped Transformer با ترکیب رمزگذار علی و رمزگشای بازگشتی، عمق محاسباتی مدل را متناسب با طول توالی افزایش میدهد. این رویکرد تلاش میکند استدلال نهان را با…

اپل نسل سوم مدلهای بنیادی خود را معرفی کرد که با معماری پراکنده، اجرای مدلهای ۲۰ میلیارد پارامتری را روی سختافزار مصرفکننده ممکن میکند. این سامانه بار محاسباتی را بین…

عامل هوش مصنوعی KubeIntellect با جایگزینی شهود مدل با حفاظهای سختافزاری و نظارت انسانی، از توهمات خطرناک در مدیریت کوبرنتیز جلوگیری میکند. این ابزار اولویت را به شواهد قابل…

محک جدید Real-SWE نشان میدهد حتی پیشرفتهترین مدلهای هوش مصنوعی در مواجهه با کدهای خصوصی و پیچیده شرکتها شکست میخورند. در این ارزیابی، مدل Fable 5.1 با نرخ موفقیت ۳۸.۸٪ بهترین…

یک بنچمارک کنترلشده نشان میدهد که قابلیت تأیید هندسی در CadQuery، آن را به گزینهای برتر از OpenSCAD برای عاملهای خودمختار تبدیل میکند. در حالی که OpenSCAD سریعتر است، اما…

کالبدشکافی یک زیرساخت تولیدی نشان میدهد چگونه حلقههای عاملمحور و مدلهای استدلالی، هزینههای پنهانی ایجاد میکنند که در ماشینحسابهای قیمتگذاری استاندارد دیده نمیشوند. این…

شرکت OpenAI با معرفی قابلیت Structured Outputs، تضمین میکند که پاسخهای مدل ۱۰۰٪ با طرحواره (Schema) تعریفشده کاربر مطابقت داشته باشد. این سیستم با استفاده از رمزگشایی محدود،…

پژوهشگران دریافتند که مراحل استدلال در خروجی متنی هوش مصنوعی، متناظر با الگوهای عددی مشخصی در لایههای داخلی مدل است. این یافته نشان میدهد منطق مدل عمیقتر از کلمات است و حتی در…