پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۶۹ مقاله منتشر شده

قضاوت دو محور دارد. جِو یکی را فرو ریخت. تقریباً هیچ‌کس در محور دیگر نمی‌دود.

استدلال‌های قابل‌دفاع در برابر پاسخ‌های سریع در تصمیمات حساس AI

در حالی که مدل‌های جدیدی مانند Jev بر سرعت استثنایی و هزینه کم تمرکز دارند، شکافی عمیق در تصمیمات حساس و غیرقابل‌بازگشت وجود دارد. ظهور «داوران کند» مانند Decider نشان‌دهنده چرخش…

۷ دقیقه خواندن
تبدیل GLM-5.3-Flash به مدل سیستم یکی شبیه جِو
آموزش کاربردی

آیا خواندن Logprobs می‌تواند مدل‌های زبانی را به سرعت Jev برساند؟

پژوهشگران راهکاری برای تبدیل مدل‌های زبانی عمومی به مدل‌های تصمیم‌گیرنده با سرعت بسیار بالا یافته‌اند. این روش به‌جای تولید متن، توزیع احتمالات توکن‌ها را می‌خواند و در مدل…

۱۰ دقیقه خواندن۲
دیدگاه آکسلو در استفاده از مدل‌های زبانی بزرگ برای تشخیص قصد کاربر
آموزش کاربردی

قیمت‌گذاری ثابت در برابر توکنی؛ راهکاری برای ارسال تاریخچه کامل گفتگو

پلتفرم Oxlo.ai برای کاهش هزینه‌های پردازش متون طولانی، مدل پرداخت توکنی را با هزینه ثابت به‌ازای هر درخواست جایگزین کرد. این تغییر به توسعه‌دهندگان اجازه می‌دهد بدون نگرانی از…

۵ دقیقه خواندن
اثبات معیار سختی صفر p28-zero-diff
آموزش کاربردی

آیا مدل‌های هوش مصنوعی ساده‌ترین اثبات‌های ریاضی را پاس می‌کنند؟

یک بنچمارک مینیمال به نام p28-zero-diff معرفی شده است که توانایی مدل‌های هوش مصنوعی در حل ساده‌ترین اثبات‌های ریاضی را می‌سنجد. این ابزار به جای چالش‌های سخت، به عنوان یک «تست…

۲ دقیقه خواندن
همه چیز به عامل هوش مصنوعی نیاز ندارد
آموزش کاربردی

مالیات استقلال؛ چرا اکثر عامل‌های هوش مصنوعی پیچگی بی‌مورد هستند؟

افزودن استقلال به نرم‌افزارها اغلب هزینه‌ای از پیچیدگی، تأخیر و خطاهای پیش‌بینی‌نشده ایجاد می‌کند بدون آنکه ارزش واقعی بیفزاید. کلید موفقیت در تفکیک ورودی‌های مبهم (که به هوش…

۸ دقیقه خواندن۱
مطالعه: دسترسی به هوش مصنوعی، تمایل به گفتن «نمی‌دانم» را تقریباً از بین می‌برد

دسترسی به هوش مصنوعی نرخ پاسخ‌های «نمی‌دانم» را به ۳٪ رساند

پژوهش‌های جدید نشان می‌دهد دسترسی به مدل‌های زبانی، تمایل انسان‌ها به پذیرش عدم قطعیت را به‌طور کامل از بین می‌برد. این اثر باعث افزایش شدید اعتمادبه‌نفس کاربران می‌شود، اما دقت…

۵ دقیقه خواندن
بهینه‌سازی مدل زبانی بزرگ برای دقت بالا با Oxlo
آموزش کاربردی

گزارش Oxlo.ai: تایید چندمرحله‌ای دقت عامل‌های تشخیص شدت حوادث را بالا برد

پلتفرم Oxlo.ai با استفاده از یک خط لوله تأیید چندمرحله‌ای و رای‌گیری مدل‌ها، دقت عامل‌های تشخیص شدت حوادث (Triage) را افزایش داد. این سیستم با ترکیب سخت‌گیری در ساختار داده‌ها و…

۵ دقیقه خواندن۲
هوش مصنوعی GPT-6 Astra می‌تواند دقیقاً بگوید کجای مونتاژ قفسه ایکیا را اشتباه انجام دادید

OpenAI: شناسایی ۸۰ درصدی نقص‌های فیزیکی در دنیای واقعی توسط Astra

مدل جدید OpenAI در شناسایی اشتباهات فیزیکی هنگام سرهم کردن وسایل خانه جهشی بزرگ داشته است. این دستاورد نشان‌دهنده پیشرفت جدی در استدلال بصری برای وظایف پیچیده دنیای واقعی است.

۱ دقیقه خواندن