پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۷۳ مقاله منتشر شده

رمزگشایی از ترفند انویدیا برای ۵ برابر سریع‌تر کردن عامل‌های هوش مصنوعی
آموزش کاربردی

رمزگشایی از ترفند انویدیا برای ۵ برابر سریع‌تر کردن عامل‌های هوش مصنوعی

انویدیا با بهینه‌سازی موتور استنتاج Dynamo، گلوگاه‌های حیاتی در جریان‌های کاری عامل‌محور را برطرف کرد. این تغییرات با حذف تداخلات متادیتای نشست، سرعت پاسخ‌دهی را به شدت افزایش…

۳ دقیقه خواندن
رویاپردازی ماشین‌ها؛ ترفند جدید آنتروپیک برای خلق عامل‌های بی‌خطا

رویاپردازی ماشین‌ها؛ ترفند جدید آنتروپیک برای خلق عامل‌های بی‌خطا

آنتروپیک با معرفی قابلیت «رویاپردازی»، به عامل‌های AI اجازه می‌دهد تا از اشتباهات گذشته درس بگیرند و حافظه خود را بهینه‌سازی کنند. این گام بزرگ، مسیر تبدیل چت‌بات‌ها به کارمندان…

۳ دقیقه خواندن
پایان عصر بازآموزی؛ Memini چگونه حافظه‌ی مدل‌های زبانی را زنده می‌کند

پایان عصر بازآموزی؛ Memini چگونه حافظه‌ی مدل‌های زبانی را زنده می‌کند

سیستم Memini با شبیه‌سازی مکانیسم‌های بیولوژیکی مغز، حافظه‌ی خارجی مدل‌های زبانی را پویا می‌کند. این فناوری اجازه می‌دهد مدل‌ها بدون نیاز به بازآموزی، حقایق جدید را بیاموزند و…

۲ دقیقه خواندن۱
رمزگشایی از PBSD؛ پایان عصر ناپایداری در تقطیر خودکار مدل‌ها

رمزگشایی از PBSD؛ پایان عصر ناپایداری در تقطیر خودکار مدل‌ها

پژوهشگران روش جدیدی به نام PBSD را معرفی کرده‌اند که با جایگزینی تطبیق KL با تنظیم منظم پاداش، پایداری آموزش را افزایش می‌دهد. این رویکرد باعث جهش در توانایی‌های استدلالی و…

۲ دقیقه خواندن۱
تغییر ساختاری در تفکر ماشین‌ها؛ چرا گراف‌ها بر متون پیروز شدند؟

تغییر ساختاری در تفکر ماشین‌ها؛ چرا گراف‌ها بر متون پیروز شدند؟

پژوهشگران چارچوب **گراف‌های ایده‌ی تکاملی** (Evolving Idea Graphs) را معرفی کردند که با جایگزینی متون خطی با گراف‌های پویا، کیفیت ایده‌های علمی را متحول می‌کند. این سیستم در…

۲ دقیقه خواندن۱
مطالعه Arxiv: دقت ۷۵ درصدی Gemini 2.5 Pro در شبیه‌سازی الگوهای شناختی

مطالعه Arxiv: دقت ۷۵ درصدی Gemini 2.5 Pro در شبیه‌سازی الگوهای شناختی

محققان با استفاده از Gemini 2.5 Pro سیستمی برای خلق «همزادهای شناختی» ساخته‌اند که می‌تواند الگوهای تفکر انسان را با دقت ۷۵ درصد بازسازی کند. این دستاورد، مسیر آموزش شخصی‌سازی‌شده…

۲ دقیقه خواندن۱
چرا برای رسیدن به هوش واقعی باید ترنسفورمرها را دور ریخت؟

چرا برای رسیدن به هوش واقعی باید ترنسفورمرها را دور ریخت؟

مدل جدیدی به نام Gyan با جایگزینی معماری ترنسفورمر، توهمات را حذف و هزینه‌های محاسباتی را به شدت کاهش داده است. این مدل با جداسازی نمایش دانش از پردازش زبان، استانداردهای جدیدی در…

۲ دقیقه خواندن۱
ترنسفورمرها یا مدارهای ریاضی؟ مرزی که لنا ارموت فروپاشاند

ترنسفورمرها یا مدارهای ریاضی؟ مرزی که لنا ارموت فروپاشاند

پژوهشی جدید ثابت می‌کند رمزگذارهای ترنسفورمر می‌توانند مدارهای محاسباتی پیچیده را شبیه‌سازی کنند. این کشف تئوریک، شکاف میان معماری‌های عصبی و منطق سخت‌افزاری را می‌پرهیزد.

۲ دقیقه خواندن۲