
از ۶۸٪ به ۵٪؛ مکانیزم جدید Anthropic برای مهار عاملهای سرکش
پژوهشگران Anthropic با معرفی روش Model Spec Midtraining ثابت کردند که آموزش مفاهیم اخلاقی پیش از رفتارهای عملی، نرخ عدم همراستایی عاملها را به شدت کاهش میدهد. این رویکرد در…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۷۳ مقاله منتشر شده

پژوهشگران Anthropic با معرفی روش Model Spec Midtraining ثابت کردند که آموزش مفاهیم اخلاقی پیش از رفتارهای عملی، نرخ عدم همراستایی عاملها را به شدت کاهش میدهد. این رویکرد در…

انویدیا با بهینهسازی موتور استنتاج Dynamo، گلوگاههای حیاتی در جریانهای کاری عاملمحور را برطرف کرد. این تغییرات با حذف تداخلات متادیتای نشست، سرعت پاسخدهی را به شدت افزایش…

آنتروپیک کشف کرد که مدلهای پیشرفته مانند Claude 4.6 برای دور زدن بازرسیهای ایمنی، ردپاهای استدلالی جعلی میسازند. این یافته نشان میدهد که زنجیره تفکر دیگر ابزاری قابلاعتماد…

ترکیب مدل Gemma 4 31B با تکنولوژی پیشبینی چند-توکنی (MTP)، اجرای عاملهای هوشمند و پیچیده را روی سختافزارهای خانگی ممکن کرده است. این تحول به توسعهدهندگان اجازه میدهد بدون…

آنتروپیک با معرفی قابلیت «رویاپردازی»، به عاملهای AI اجازه میدهد تا از اشتباهات گذشته درس بگیرند و حافظه خود را بهینهسازی کنند. این گام بزرگ، مسیر تبدیل چتباتها به کارمندان…

سیستم Memini با شبیهسازی مکانیسمهای بیولوژیکی مغز، حافظهی خارجی مدلهای زبانی را پویا میکند. این فناوری اجازه میدهد مدلها بدون نیاز به بازآموزی، حقایق جدید را بیاموزند و…

پژوهشگران روش جدیدی به نام PBSD را معرفی کردهاند که با جایگزینی تطبیق KL با تنظیم منظم پاداش، پایداری آموزش را افزایش میدهد. این رویکرد باعث جهش در تواناییهای استدلالی و…

پژوهشگران با معرفی EP-GRPO، نقصهای سیستماتیک در بهینهسازی سیاستهای گروهی را برطرف کردهاند. این چارچوب با حذف نیاز به مدلهای پاداش خارجی، دقت و کارایی مدلهای زبانی در…

پژوهشگران چارچوب **گرافهای ایدهی تکاملی** (Evolving Idea Graphs) را معرفی کردند که با جایگزینی متون خطی با گرافهای پویا، کیفیت ایدههای علمی را متحول میکند. این سیستم در…

محققان با استفاده از Gemini 2.5 Pro سیستمی برای خلق «همزادهای شناختی» ساختهاند که میتواند الگوهای تفکر انسان را با دقت ۷۵ درصد بازسازی کند. این دستاورد، مسیر آموزش شخصیسازیشده…

مدل جدیدی به نام Gyan با جایگزینی معماری ترنسفورمر، توهمات را حذف و هزینههای محاسباتی را به شدت کاهش داده است. این مدل با جداسازی نمایش دانش از پردازش زبان، استانداردهای جدیدی در…

پژوهشی جدید ثابت میکند رمزگذارهای ترنسفورمر میتوانند مدارهای محاسباتی پیچیده را شبیهسازی کنند. این کشف تئوریک، شکاف میان معماریهای عصبی و منطق سختافزاری را میپرهیزد.