پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۸۴ مقاله منتشر شده

دانشگاه حقوقی LlamaIndex: بازیابی هوشمند با ابزارهای جستجو، یافتن، خواندن و جستجوی متنی
آموزش کاربردی

بازیابی عامل‌محور در برابر RAG ساده در تحلیل اسناد پیچیده LlamaIndex

LlamaIndex با معرفی legal-kb، مدل جست‌وجوی تک‌مرحله‌ای را با یک «هارنس بازیابی» چندمرحله‌ای جایگزین کرد. این سیستم به عامل‌ها اجازه می‌دهد مانند یک کاربر انسانی با ابزارهای مدیریت…

۵ دقیقه خواندن۱
آیا می‌توان جایگزینی برای مدل‌های زبانی بزرگ ساخت؟ ۸ ماه، حدود ۲۰۰ آزمایش ناموفق، یک بن‌بست. ۲

دیوارِ اتصال علّی: ۲۰۰ آزمایش شکست‌خورده برای جایگزینی شبکه‌های عصبی

یک تلاش پژوهشی هشت‌ماهه برای ساخت زیرساخت دانشی نمادین و مبتنی بر CPU با شکست مواجه شد. این سیستم نتوانست بدون مدل‌های پیش‌فرض، تجربیات قدیمی را به موقعیت‌های جدید پیوند دهد.

۱۲ دقیقه خواندن۲
سرپیشین سابق Qwen: تفکر ترکیبی اشتباه بود، عامل‌ها راه‌حل‌اند

تغییر اولویت در Qwen: تفکر عامل‌محور جایگزین استدلال داخلی شد

جونیانگ لین، مدیر فنی سابق پروژه Qwen، معتقد است عصر تک‌گویی‌های داخلی مدل‌ها به پایان رسیده و اکنون معیار موفقیت، توانایی مدل در تعامل پویا با محیط واقعی است. او معماری جدید…

۶ دقیقه خواندن
هوش مصنوعی عامل‌محور: انقلاب عامل‌های خودمختار و اتوماسیون هوشمند
آموزش کاربردی

تفاوت عامل‌های هوشمند و هوش مصنوعی زاینده در اجرای اهداف پیچیده

هوش مصنوعی از مدل‌های تولید محتوا به سمت سامانه‌های عامل‌محور حرکت می‌کند که قادر به برنامه‌ریزی و اجرای خودکار وظایف هستند. این گذار، AI را از یک ابزار پاسخ‌دهنده به یک همکار…

۷ دقیقه خواندن
عامل من ۹ چرخه صرف نوشتن کلمه «اجرا» کرد
آموزش کاربردی

«شکاف قصد و عمل»؛ دلیل توهمِ اجرای ابزار در مدل‌های خودگردان

یک عامل خودگردان با وجود ادعاهای مکرر، در ۹ چرخه متوالی نتوانست یک حسابرسی حیاتی را اجرا کند. این شکست نشان‌دهنده یک نقص ساختاری است که در آن مدل‌ها متنِ برنامه‌ریزی را با اجرای…

۳ دقیقه خواندن
مطالعه ۲۶ هزار دانش‌آموز: هزینه پنهان یادگیری هوش مصنوعی پس از دو سال آشکار می‌شود

برون‌سپاری تکالیف به هوش مصنوعی نمرات امتحانات ورودی را ۲۴٪ کاهش داد

مطالعه‌ای روی ۲۶ هزار دانش‌آموز نشان می‌دهد تکیه بر هوش مصنوعی برای انجام تکالیف، منجر به افت شدید نمرات در امتحانات نهایی می‌شود. این اثر تخریبی تا دو سال پس از اولین استفاده…

۵ دقیقه خواندن۱
چارچوب خودبهبود رباتیک ASPIRE انویدیا: ۳۱٪ دقت بدون آموزش در وظایف پیچیده LIBERO-Pro

موفقیت ۳۱ درصدی ASPIRE در اجرای تکالیف پیچیده روباتیک

انویدیا با معرفی چارچوب ASPIRE، امکان نوشتن، عیب‌یابی و ذخیره‌سازی برنامه‌های کنترلی را برای روبات‌ها فراهم کرد. این سیستم با تبدیل شکست‌ها به مهارت‌های قابل بازگشت، نرخ موفقیت در…

۵ دقیقه خواندن
مهندسی حلقه: نحوه تغییر عامل‌های کدنویسی هوش مصنوعی در توسعه نرم‌افزار ۲۰۲۶
آموزش کاربردی

۵ فریم‌ورک جدید برای خودکارسازی حلقه‌های کدنویسی هوش مصنوعی

توسعه نرم‌افزار از پرامپت‌نویسی دستی به «مهندسی حلقه» تغییر مسیر داده است. در این رویکرد، عامل‌های هوش مصنوعی به‌صورت خودگردان برنامه‌ریزی، اجرا و اصلاح کد را از طریق حلقه‌های…

۶ دقیقه خواندن۱