
چرا اصلاح تابع پاداش برای حل خطاهای پیچیده در مدلهای زبانی کافی نیست؟
پژوهشی جدید با معرفی یک سیستم مختصاتی ریاضی، بهینهسازی سیاستهای مدلهای زبانی را به جای ترفندهای تجربی به یک علم تشخیصی تبدیل کرده است. این چارچوب نشان میدهد که بسیاری از…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۰ مقاله منتشر شده

پژوهشی جدید با معرفی یک سیستم مختصاتی ریاضی، بهینهسازی سیاستهای مدلهای زبانی را به جای ترفندهای تجربی به یک علم تشخیصی تبدیل کرده است. این چارچوب نشان میدهد که بسیاری از…

پژوهشگران پیشنهاد کردهاند که هوش مصنوعی پزشکی از مدلهای تشخیص ایستا به «مدلهای جهانی» تغییر مسیر دهد. هدف این رویکرد، تبدیل سیستمها از امتیازدهی ریسک به شبیهسازی پویا از مسیر…

پژوهشگران چارچوب User as Code (UaC) را معرفی کردند که حافظه متنی هوش مصنوعی را با اشیاء و توابع قابلاجرای پایتون جایگزین میکند. این تغییر پارادایم، دقت پاسخدهی عاملها به…

پژوهشهای جدید نشان میدهد که در حالی که تحلیل متن برای تشخیص وضعیت عاطفی فعلی کاربر دقیق است، اما در پیشبینی تغییرات آتی ناکارآمد است. در مقابل، تحلیل دینامیکهای عددیِ…

بنچمارک جدید CoffeeBench نشان میدهد که برخی مدلهای زبانی با وجود توانایی برنامهریزی دقیق، در محیطهای اقتصادی بلندمدت دچار «بیعملی» میشوند. Claude Haiku 4.5 در این آزمون…

پژوهشگران با معرفی چارچوب Tensor-Coord، برنامهریزی در سیستمهای چندعاملی را از مذاکرات شکننده بر پایه پرامپت به همراستاسازی ریاضی منتقل کردند. این روش با استفاده از تجزیه جبری…

چارچوب MGIL با استفاده از خوشهبندی موجودیتها، یک «گراف مدل» ایجاد میکند تا الگوهای ساختاری سراسری را شناسایی کند. این رویکرد در پیشبینی استقرایی پیوندها (Inductive Link…

پژوهشگران چارچوبی به نام EC-Script توسعه دادهاند که به مدلهای زبانی اجازه میدهد روایتهای داستانی را با مسیرهای احساسی دقیق، مخصوص هنردرمانی، تولید کنند. این سیستم از یک ساختار…

تحقیقات جدید نشان میدهد عاملهای هوش مصنوعی اغلب ابزار درست را شناسایی میکنند اما در مرحله نهایی تصمیمگیری دچار خطا میشوند. این یافته، اثربخشی روشهای رایج مهندسی پرامپت برای…

یک چارچوب جدید به سیاستهای RMAPPO اجازه میدهد در لحظهی اجرا از قوانین خارجی یا راهنماییهای مدلهای زبانی استفاده کنند تا سرعت بازیابی خطوط تولید پس از نقص فنی افزایش یابد. این…

یک ممیزی روی ۱۲ مدل هوش مصنوعی نشان میدهد که جایگاه یک هتل در لیست دادهها، بهطور مستقل بر توصیهی مدل اثر میگذارد. این سوگیری ساختاری باعث میشود ارزش ادراکی هر اتاق شبانه…

متد MHL وزنهای مبهم شبکههای عصبی را با قوانین قطعی پایتونی جایگزین میکند. این چارچوب دقت بالای استانداردهای فعلی را در دادههای پزشکی حفظ کرده و در عین حال قابلیت بازبینی کامل…