
AutoSynthData: تبدیل شکستهای عاملهای هوش مصنوعی به دادههای آموزشی
سرویسنو (ServiceNow) سیستمی را معرفی کرد که نقاط ضعف عاملهای هوش مصنوعی در محیطهای سازمانی را شناسایی و بهطور خودکار به دادههای آموزشی تبدیل میکند. این رویکرد با استفاده از…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۶۹ مقاله منتشر شده

سرویسنو (ServiceNow) سیستمی را معرفی کرد که نقاط ضعف عاملهای هوش مصنوعی در محیطهای سازمانی را شناسایی و بهطور خودکار به دادههای آموزشی تبدیل میکند. این رویکرد با استفاده از…

یک محک جدید بر اساس مناقشات واقعی در هند نشان میدهد مدلهای «متفکر» بیش از مدلهای دستوری معمولی مستعد سوگیری جمعیتی هستند. توکنهای استدلالی بهجای ارتقای انصاف، اغلب به ابزاری…

یک معماری جدید هوش مصنوعی با ترکیب مدلهای انتشار و سیاستهای عاملمحور، اتلاف منابع در زنجیره تأمین را به شدت کاهش میدهد. این سیستم با افزودن یک لایه حسابرسی رمزنگاریشده، از…

یک محک فنی روی دادههای حملونقل مادرید نشان داد که گراف دانش .me با رشد ۱۰۰ برابری حجم دادهها، سرعت انتشار تغییرات را حفظ میکند. این آزمایش ثابت کرد که هزینه محاسباتی…

یک پژوهشگر با استفاده از Opus 5.5 میلیونها سند شرکت هند شرقی هلند را بررسی کرد و به لاگ کشتی سال ۱۶۱۵ دست یافت که شکار پرنده منقرضشدهی دودو را ثبت کرده است. این یافته نشان…

یک کالبدشکافی فنی نشان میدهد «تنبلی مدل» در محیط تولید معمولاً نتیجهی باگهای لایهی ارکستراسیون است، نه افت کیفیت مدل. محدودیتهای سختگیرانه در تلاش مجدد و معیارهای موفقیت…

یک چارچوب معماری جدید، جایگزین ریختن دادههای خام در پرامپتها شده و از یک خط لوله چهارمرحلهای دقیق استفاده میکند. این سیستم با تبدیل پنجره متنی به حافظه کش L1، حلقههای توهم و…

تیم آیندههای استراتژیک OpenAI در پلتفرم جدید خود استدلال میکند که با ارزان شدن «نابغه بودن» مدلها، گلوگاه پیشرفت بشری از ایدهپردازی به اجرای فیزیکی و کسالتبار تغییر میکند.

متیو شوارتز ابزار متنباز BootLoops 1.0 را برای تبدیل LLMها به ماشینهای محاسباتی با دقت بالا معرفی کرد. این سیستم توانسته است مسائل ریاضی ۲۰ ساله در حوزههای اکولوژی و ژنتیک را…

پژوهشگران NVIDIA و KAIST با معرفی متد Mid-Harness، فیلترینگ دستورات را پیش از اجرا جایگزین اجرای مجدد کل مسیر کردند. این رویکرد بدون افت عملکرد، هزینههای محاسباتی را بهشدت کاهش…

یک محک امنیتی جدید نشان میدهد مدلهای کوچک هوش مصنوعی بهجای استاندارد مرورگرها، از منطق پایتون برای تحلیل URLها استفاده میکنند. این تضاد فنی به مهاجمان اجازه میدهد با دور زدن…

شبکههای عصبی با شبیهسازی ساختار نورونهای بیولوژیک، الگوهای پیچیده در دادهها را شناسایی میکنند. این راهنما چرخه ریاضی پیشبینی، اندازهگیری خطا و تنظیم وزنها را که هسته اصلی…