پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۷۳ مقاله منتشر شده

چرا پنجره‌های بافت بزرگ‌تر راه نجات عامل‌های هوش مصنوعی نیستند؟

چرا پنجره‌های بافت بزرگ‌تر راه نجات عامل‌های هوش مصنوعی نیستند؟

پژوهشگران با معرفی LongSeeker، پارادایم جدیدی برای مدیریت حافظه در عامل‌های جستجو ایجاد کرده‌اند. این مدل با حذف داده‌های زائد، دقت جستجوهای پیچیده را به ۶۲.۵٪ رسانده و رقبای…

۲ دقیقه خواندن۲
گزارش arxiv: مدل‌های دنیای قابل‌اجرا ۷ بازی پیچیده ARC-AGI-3 را حل کردند

گزارش arxiv: مدل‌های دنیای قابل‌اجرا ۷ بازی پیچیده ARC-AGI-3 را حل کردند

یک سیستم جدید عامل‌محور توانسته است با ساخت و بازنویسی مدل‌های دنیای پایتونی، پازل‌های پیچیده ARC-AGI-3 را حل کند. این دستاورد، معیار جدیدی برای استدلال عمومی در هوش مصنوعی تعریف…

۲ دقیقه خواندن
عبور از دیوار نمایی؛ متد جدید آنوای شاه برای تسخیر بازی‌های پیچیده

عبور از دیوار نمایی؛ متد جدید آنوای شاه برای تسخیر بازی‌های پیچیده

پژوهشگران راهی برای اجرای الگوریتم‌های استاندارد Bandit در مسائل T-MDP یافته‌اند که مانع رشد نمایی حافظه می‌شود. این متد با استفاده از کران‌های اطمینان مشترک، محاسبات را به سطح…

۲ دقیقه خواندن
چگونه NRI استدلال نمادین را به یک مدل بنیادی تبدیل کرد؟

چگونه NRI استدلال نمادین را به یک مدل بنیادی تبدیل کرد؟

پژوهشگران مدل NRI را معرفی کردند؛ سیستمی که می‌تواند بدون نیاز به بازآموزی، قوانین منطقی را در حالت صفر-شات استخراج کند. این مدل با تکیه بر ویژگی‌های آماری، استدلال نمادین را از…

۲ دقیقه خواندن۱
Strat-Reasoner؛ پایان شکست‌های مدل‌های زبانی در بازی‌های استراتژیک

Strat-Reasoner؛ پایان شکست‌های مدل‌های زبانی در بازی‌های استراتژیک

پژوهشگران چارچوب جدیدی به نام Strat-Reasoner معرفی کرده‌اند که به مدل‌های زبانی اجازه می‌دهد فرآیند استدلال رقبای خود را مدل‌سازی کنند. این رویکرد بازگشتی منجر به افزایش ۲۲.۱…

۲ دقیقه خواندن۱
معماری «چشم-مغز-دهان»؛ نقطه عطف در واقع‌گرایی عامل‌های چندوجهی

معماری «چشم-مغز-دهان»؛ نقطه عطف در واقع‌گرایی عامل‌های چندوجهی

پژوهشگران با معرفی چارچوب EBM-RL، فرآیند ادراک، استدلال و بیان را از هم تفکیک کردند تا نقش‌آفرینی در ویدئو را متحول کنند. این مدل با استفاده از چهار پاداش مجزا، هماهنگی میان…

۲ دقیقه خواندن۱
پایان عصر داده‌های برچسب‌دار؛ چگونه SensingAgents ابهام حسگرها را می‌زداید

پایان عصر داده‌های برچسب‌دار؛ چگونه SensingAgents ابهام حسگرها را می‌زداید

پژوهشگران با معرفی SensingAgents، چارچوبی عامل‌محور ایجاد کرده‌اند که تشخیص فعالیت‌های انسانی را از طریق شبیه‌سازی بحث‌های استدلالی بهبود می‌بخشد. این سیستم در حالت Zero-shot،…

۲ دقیقه خواندن۲
توهم اخلاق؛ چرا «تفکر» در AI فقط یک فیلتر سازگاری است؟

توهم اخلاق؛ چرا «تفکر» در AI فقط یک فیلتر سازگاری است؟

پژوهشی جدید روی ۵ مدل پیشرو نشان می‌دهد که حالت استدلالی تأثیری در تغییر احکام اخلاقی ندارد، اما تضاد بین مدل‌ها را در سناریوهای پیچیده کاهش می‌دهد. در واقع، «تفکر» بیشتر یک ابزار…

۲ دقیقه خواندن
چگونه اوبر با مدل‌های استدلالی OpenAI فشار ذهنی رانندگان را گرفت
آموزش کاربردی

چگونه اوبر با مدل‌های استدلالی OpenAI فشار ذهنی رانندگان را گرفت

اوبر با پیاده‌سازی یک معماری عامل‌محور بر پایه OpenAI، منوهای پیچیده اپلیکیشن را با راهنمایی‌های صوتی و استدلالی جایگزین کرده است. این سیستم با هدف بهینه‌سازی درآمد رانندگان و…

۳ دقیقه خواندن