پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۸۸ مقاله منتشر شده

تنظیم دقیق و RAG: درس‌هایی از دوازده آزمایش ناموفق
آموزش کاربردی

مدل‌های کوچک در پیش‌بینی‌های مالی نویزی بر مدل‌های غول‌آسا پیروز شدند

آزمایش‌های جدید نشان می‌دهد که تنظیم دقیق و RAG نمی‌توانند سیگنال‌های پیش‌بینی‌کننده را در داده‌های نویزی خلق کنند. مدل‌های بزرگ‌تر تمایل دارند به جای الگو، «نویز» را حفظ کنند و…

۸ دقیقه خواندن۱
نگهداری گزینه‌های ردشده در سیاهه تصمیم عامل هوشمند
آموزش کاربردی

ثبت گزینه‌های ردشده؛ راهکاری برای بازگشت سریع عامل‌های AI به مسیر درست

یک پیشنهاد فنی جدید برای ثبت وقایع عامل‌های هوش مصنوعی، توصیه می‌کند به جای ثبت صرفِ مسیر طی‌شده، دلایل رد گزینه‌های جایگزین نیز ذخیره شوند. این رویکرد اجازه می‌دهد انسان‌ها مرز…

۳ دقیقه خواندن۱
شبیه‌ساز مورفیوس: بنچمارک یادگیری تقویتی پیوسته در محیط‌های سازمانی غیرایستا

بِنچمارک MORPHEUS: عامل‌های یادگیری تقویتی در محیط‌های پویا شکست می‌خورند

پلتفرم MORPHEUS نشان داد که الگوریتم‌های رایج یادگیری تقویتی هنگام مواجهه با تغییرات محیطی در سازمان‌ها، توانایی تطبیق ندارند. این نتایج شکاف عمیقی را در قابلیت‌های یادگیری مستمر…

۵ دقیقه خواندن
جاکارد: زبان برنامه‌نویسی کوچک برای دورانی که بیشتر کدها توسط مدل‌های یادگیری ماشین نوشته و توسط انسان‌ها بازبینی می‌شوند.
آموزش کاربردی

Jacquard در برابر زبان‌های سنتی؛ اولویتِ تائید ماشین بر نگارش انسان

زبان Jacquard برای آینده‌ای طراحی شده که در آن ماشین‌ها کد می‌زنند و انسان‌ها فقط بازبینی می‌کنند. این زبان با جایگزینی کامنت‌ها با محدودیت‌های سخت‌افزاری در سطح سینتکس، امنیت و…

۱۴ دقیقه خواندن
عامل هوش مصنوعی ChatGPT Work برای مدیریت کامل گردش کار معرفی شد
آموزش کاربردی

چگونه دستورات هدف‌محور جایگزین اسکریپت‌های گام‌به‌گام در OpenAI می‌شوند؟

شرکت OpenAI چارچوب جدیدی برای مهندسی پرامپت معرفی کرد که در آن تمرکز از دستورات پیچیده به درخواست‌های هدف‌محور تغییر یافته است. این راهنما تفاوت دقیقی میان وظایف سریع «چت» و…

۳ دقیقه خواندن