
چرا پنجرههای بافت بزرگتر راه نجات عاملهای هوش مصنوعی نیستند؟
پژوهشگران با معرفی LongSeeker، پارادایم جدیدی برای مدیریت حافظه در عاملهای جستجو ایجاد کردهاند. این مدل با حذف دادههای زائد، دقت جستجوهای پیچیده را به ۶۲.۵٪ رسانده و رقبای…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۱۸ مقاله منتشر شده

پژوهشگران با معرفی LongSeeker، پارادایم جدیدی برای مدیریت حافظه در عاملهای جستجو ایجاد کردهاند. این مدل با حذف دادههای زائد، دقت جستجوهای پیچیده را به ۶۲.۵٪ رسانده و رقبای…

یک سیستم جدید عاملمحور توانسته است با ساخت و بازنویسی مدلهای دنیای پایتونی، پازلهای پیچیده ARC-AGI-3 را حل کند. این دستاورد، معیار جدیدی برای استدلال عمومی در هوش مصنوعی تعریف…

رباتهای خانگی در حال خروج از شبیهسازها و ورود به محیطهای واقعی هستند، اما سیستمهای امنیتی فعلی ناکارآمدند. چارچوب جدیدی به نام SPINE پیشنهاد میکند که حریم خصوصی به جای یک…

پژوهشگران با معرفی Uno-Orchestra، سیستمی برای بهینهسازی همزمان تجزیه تکالیف و انتخاب مدل طراحی کردهاند. این رویکرد دقت را ۱۶ درصد افزایش و هزینههای استنتاج را تا ۱۰ برابر کاهش…

پژوهشگران راهی برای اجرای الگوریتمهای استاندارد Bandit در مسائل T-MDP یافتهاند که مانع رشد نمایی حافظه میشود. این متد با استفاده از کرانهای اطمینان مشترک، محاسبات را به سطح…

پژوهشگران مدل NRI را معرفی کردند؛ سیستمی که میتواند بدون نیاز به بازآموزی، قوانین منطقی را در حالت صفر-شات استخراج کند. این مدل با تکیه بر ویژگیهای آماری، استدلال نمادین را از…

پلتفرم تخصصی Gosset در شناسایی داربستهای دارویی سرطان و ایمنی، ۳.۲ برابر موفقتر از GPT-5.5 عمل کرد. این نتیجه ثابت میکند که شاخصهای دادهای منتخب، بر جستجوی عمومی مدلهای…

پژوهشگران چارچوب جدیدی به نام Strat-Reasoner معرفی کردهاند که به مدلهای زبانی اجازه میدهد فرآیند استدلال رقبای خود را مدلسازی کنند. این رویکرد بازگشتی منجر به افزایش ۲۲.۱…

پژوهشگران با معرفی چارچوب EBM-RL، فرآیند ادراک، استدلال و بیان را از هم تفکیک کردند تا نقشآفرینی در ویدئو را متحول کنند. این مدل با استفاده از چهار پاداش مجزا، هماهنگی میان…

پژوهشگران با معرفی سیستم BAOC ثابت کردند که استفاده از یک بهینهساز واحد برای کل مدل، باعث اتلاف شدید حافظه میشود. این ابزار با تخصیص تنظیمات مجزا به هر بلوک شبکه، مصرف منابع را…

پژوهشگران با معرفی AuditRepairBench، راهکاری برای توقف تقلب عاملهای AI در ارزیابیهای کدنویسی ارائه کردند. این چارچوب با کاهش ۶۲ درصدی نوسانات رتبهبندی، معیارهای عملکردی…

پژوهشگران با معرفی SensingAgents، چارچوبی عاملمحور ایجاد کردهاند که تشخیص فعالیتهای انسانی را از طریق شبیهسازی بحثهای استدلالی بهبود میبخشد. این سیستم در حالت Zero-shot،…