پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۷۶ مقاله منتشر شده

نمودار فرآیند RAG: بازیابی اطلاعات از منابع خارجی و تولید پاسخ توسط هوش مصنوعی
آموزش کاربردی

تولید بازیابی‌افزا (RAG) توهمات هوش مصنوعی را با جریان پنج‌مرحله‌ای داده‌ها

تولید بازیابی‌افزا (RAG) با اتصال مدل‌ها به داده‌های به‌روز و خصوصی در لحظه استنتاج، مانع از توهمات متقاعدکننده مدل‌های ایستا می‌شود. این چارچوب با تفکیک بازیابی شواهد از تنظیم…

۱۱ دقیقه خواندن۳
عامل شما واقعیت را به خاطر سپرده بود، اما مثل یک غریبه پاسخ داد.

دقت بازیابی در برابر توانایی استنتاج؛ تضاد حافظه در مدل‌های عامل‌محور

تحلیل فنی جدیدی نشان می‌دهد عامل‌های هوش مصنوعی علی‌رغم توانایی کامل در بازیابی حقایق، در به‌کارگیری این داده‌ها برای وظایف غیرمستقیم شکست می‌خورند. این یافته ثابت می‌کند گلوگاه…

۵ دقیقه خواندن
پهپادها و هوش مصنوعی در حال تغییر جنگ و آزادی بیان هستند.

درون GPT-6 Astra؛ تضاد عملکرد پیچیده با قوانین اتحادیه اروپا

اوپن‌ای‌آی مدل GPT-6 Astra را معرفی کرد که با استفاده از تکنیک «عمق بازگشتی»، عملکرد در کارهای پیچیده را بالا برده اما فرآیند استدلال را برای ناظران انسانی نامرئی می‌کند. این عرضه…

۵ دقیقه خواندن
کارآفرین هوش مصنوعی عامل‌هایی می‌سازد که برای موارد غیرمنتظره برنامه‌ریزی کنند.

دانیجار هافنر با مدل‌های «رؤیاپرداز» ربات‌های برنامه‌ریز را می‌سازد

دانیجار هافنر، پژوهشگر سابق گوگل دیپ‌مایند، استارتاپی مخفی برای توسعه ربات‌های انسان‌نما راه‌اندازی کرده است. او با استفاده از یادگیری تقویتی مدل‌محور، به ربات‌ها اجازه می‌دهد پیش…

۴ دقیقه خواندن
تحلیل احساسات متن: بینش‌های کلیدی سودآوری
آموزش کاربردی

تبدیل لحن جلسات مالی به سیگنال‌های بازار با تحلیل احساسات NLP

پردازش زبان طبیعی (NLP) در حوزه مالی از برچسب‌های ساده مثبت/منفی فراتر رفته تا عدم قطعیت و شکاف‌های لحنی در گزارش‌های سود را ردیابی کند. تحلیلگران اکنون می‌توانند با تبدیل الگوهای…

۴ دقیقه خواندن۱
کارایی استفاده عامل‌های هوشمند از روش‌های آزمون و تأیید چقدر است؟

تأیید رسمی در برابر استدلال مدل‌ها؛ شکافی در یافتن باگ‌های پیچیده

تحلیلی فنی نشان می‌دهد عامل‌های هوش مصنوعی حتی با دستورات صریح، قادر به استفاده مؤثر از کتابخانه‌های تست پیشرفته یا متدهای تأیید رسمی نیستند. این مدل‌ها به‌جای یافتن باگ‌های…

۵۱ دقیقه خواندن۱