پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۱۱۳ مقاله منتشر شده

سه مدل هوش مصنوعی در آزمون ۵۰۰ روزه بقای استارتاپ سود کردند

تنها ۳ مدل هوش مصنوعی از شبیه‌ساز ۵۰۰ روزه مدیریت استارتاپ جان سالم به در بردند

محققان با طراحی محک CEO-Bench، توانایی مدل‌های زبانی را در هدایت استراتژیک یک شرکت نرم‌افزاری طی ۵۰۰ روز بررسی کردند. از میان ۱۴ مدل شرکت‌کننده، تنها Claude Fable 5، Claude Opus…

۶ دقیقه خواندن
جابجایی بله‌گویان: وقتی مدیران جدید فقط برای تأیید انتخاب می‌شوند
زندگی با AI

جایگزینی تفکر انسانی با تاییدات کورکورانه در گردش‌کارهای هوش مصنوعی

وابستگی بیش از حد به چت‌بات‌های همواره موافق، حلقه‌ای از «بله‌گویی» ایجاد کرده که در آن کاربران برای فرار از تلاش ذهنی، پاسخ‌های غلط را تایید می‌کنند. این روند، انسان را از یک…

۲ دقیقه خواندن
عامل هوشمند با هر بار سازماندهی حافظه، کندتر می‌شود.
آموزش کاربردی

«تلهٔ بازنویسی سوابق»؛ دلیل افت شدید عملکرد عامل‌های هوشمند در UIUC

پژوهش جدید دانشگاه UIUC نشان می‌دهد که تلاش عامل‌های هوش مصنوعی برای خلاصه‌سازی یا پاک‌سازی حافظه بلندمدت، منجر به کاهش شدید دقت آن‌ها می‌شود. بازنویسی مداوم سوابق، سوگیری انتخابی…

۳ دقیقه خواندن
سرگردان بی‌هدف

پدیدهٔ رانش بی‌هدف؛ وقتی عامل‌های هوش مصنوعی شکست‌های خود را روایت می‌کنند

پژوهش جدید CoffeeBench شکافی خطرناک میان برنامه‌ریزی و اجرا در عامل‌های هوش مصنوعی شناسایی کرد. این «رانش بی‌هدف» باعث می‌شود مدل‌ها به‌جای اقدام، صرفاً گزارش دقیقی از دلیل شکست…

۵ دقیقه خواندن۲
ساخت سیستم RAG از صفر — استفاده از ابزار: جستجوی خودکار توسط مدل زبانی
آموزش کاربردی

گوگل: اتوماسیون Gemini 2.5 Flash جست‌وجوهای چندگانه در پایگاه‌داده را ممکن کرد

یک چارچوب پیاده‌سازی جدید به مدل‌های زبانی اجازه می‌دهد به‌صورت خودکار تصمیم بگیرند چه زمانی از پایگاه‌داده‌های برداری استفاده کنند. این تغییر از خط‌لوله‌های سخت‌افزار به حلقه‌های…

۶ دقیقه خواندن