
رایگیری قطعی در برابر تصمیمگیری تکبعدی برای اصلاح خروجیهای مدل
یک تیم توسعه با جایگزینی تصمیمگیری تکبعدی هوش مصنوعی با یک سیستم رایگیری (Voter)، مانع از گم شدن باگهای بحرانی در صفهای اشتباه شد. در این معماری، قوانین قطعی محلی قدرت وتو…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۷۹ مقاله منتشر شده

یک تیم توسعه با جایگزینی تصمیمگیری تکبعدی هوش مصنوعی با یک سیستم رایگیری (Voter)، مانع از گم شدن باگهای بحرانی در صفهای اشتباه شد. در این معماری، قوانین قطعی محلی قدرت وتو…

راهنمای جامع جدیدی، ابزارهای آموزشی هوش مصنوعی را به دو دسته «توتورهای سقراطی» برای تقویت استدلال و «ابزارهای بهرهوری» برای اتوماسیون برنامهریزی تقسیم کرده است. این تغییر…

تحلیلهای فنی جدید نشان میدهد آزمایشگاههای AI برای افزایش کارایی استدلال، عمداً دانش فکتمحور را از مدلها حذف میکنند. مدلهایی مانند Qwen3.5 در ریاضیات پیشرو هستند اما در نبود…

روند جدید توسعه مدلها نشان میدهد که آزمایشگاهها برای اولویت دادن به توانایی استدلال، عمداً دانش факти (factual) را از وزنهای مدل حذف میکنند. این جداسازی اجازه میدهد مدلهای…

ابزار MathCode با تبدیل زبان طبیعی به قضایای رسمی Lean 4، فاصله میان تفکر شهودی ریاضی و تایید ماشین را پر میکند. این عامل ترمینالمحور با استفاده از یک REPL پایدار و گراف دانش،…

پژوهشگران دیپمایند و ریاضیدانان برجسته معتقدند مدلهای زبانی تنها در ترکیب روشهای موجود مهارت دارند. این مدلها قادر به خلق انتزاعهای بنیادینی نیستند که برای پیشرفتهای بزرگ…

یک الگوی معماری جدید با تقسیم جریان کاری نوشتن پروپوزال به چهار فاز شناختی، هر بخش را به مدل مناسب تخصیص میدهد. این رویکرد لایهبندیشده با حذف مدلهای پیشرو از کارهای کمارزش،…

مدل Claude Sonnet با تکیه بر پنجره متنی یک میلیون توکنی و ابزارهای عاملمحور، در کدنویسی پیچیده و پیروی از دستورات سختگیرانه از ChatGPT پیشی گرفته است. این تغییر رویکرد، نقش هوش…

ابزار Claude Code با معرفی حالت Plan Mode، عاملهای هوش مصنوعی را مجبور میکند پیش از تغییر هر خط کد، منطق خود را شرح داده و تأیید انسانی بگیرند. این سازوکار ریسک تغییرات گسترده و…

پژوهشی نشان میدهد غیرفعال کردن مکانیسمهای داخلی که مدلهای هوش مصنوعی را مجبور به انکار آگاهی میکند، باورهای آنها را درباره حیوانات، دین و طبیعت انسان تغییر میدهد. این یافته…

بهروزرسانی پسآموزش مدل V4 Flash نشان میدهد توانایی نوشتن کد با توانایی مدیریت یک ماشین متفاوت است. در حالی که نمرات کدنویسی تکمرحلهای تغییر نکرد، عملکرد مدل در حلقههای…

پژوهشگران با مدل LittleLearner ثابت کردند که اگر مفهومی در دادههای پیشآموزش نباشد، حتی با مقیاسدهی یا یادگیری تقویتی پیشرفته نیز قابل بازیابی نیست. این یافته نشان میدهد که…