پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۷۲ مقاله منتشر شده

تصویر: نمودار مقایسه توانایی‌های ریاضیاتی مدل‌های زبانی بزرگ در مسائل مختلف

ریاضیدانان از آزمایشگاه‌های AI خواستند بودجهٔ درک انسانیِ اثبات‌ها را تأمین کنند

اتحادی از ریاضی‌دانان خواستار توقف انتشار نتایج ریاضی توسط مدل‌های بسته است. آن‌ها تأکید دارند که آزمایشگاه‌های هوش مصنوعی باید بودجه و شفافیت لازم را برای تبدیل «پاسخ‌های…

۷ دقیقه خواندن۲
مخزن لایون‌نرف: معیار سنجش توانایی مدل پس از انتشار در گیت‌هاب
آموزش کاربردی

ابزار livenerf افتِ پنهانیِ کیفیت مدل‌های هوش مصنوعی را اثبات می‌کند

پلتفرم متن‌باز livenerf با استفاده از تحلیل آماری و پروتکل‌های ثبت‌شده، امکان شناسایی «نرف کردن» یا کاهش عمدی توانمندی‌های مدل‌ها پس از عرضه را فراهم می‌کند. این ابزار بحث‌های…

۱۲ دقیقه خواندن۲
درخواست هوش مصنوعی را قبل از هوشمند کردن، قابل بررسی کن
آموزش کاربردی

آیا بازرسی خروجی‌ها موثرتر از مهندسی پیچیدهٔ پرامپت است؟

یک متدولوژی جدید در مهندسی پرامپت پیشنهاد می‌کند به‌جای پیچیده‌تر کردن دستورات، بر «قابلیت بازرسی» خروجی تمرکز کنید. این رویکرد با تعریف مرزهای سخت و نمونه‌های نامقبول، نرخ توهمات…

۳ دقیقه خواندن
یک مدل، نقش‌های متعدد: تخصصی‌سازی استنتاج LLM بدون آموزش مدل‌های بیشتر
آموزش کاربردی

«بدون افت دقت»؛ استراتژی جدید برای بهینه‌سازی توکن‌های ورودی

یک رویکرد معماری جدید با معرفی «پروفایل‌های استنتاج»، تخصص مدل‌های زبانی را از طریق محدود کردن ابزارها و زمینه در هر درخواست مدیریت می‌کند. آزمایش‌های اولیه نشان داد کاهش فهرست…

۱۳ دقیقه خواندن۱
نمونه‌برداری از سلول‌های بنیادی انسان با میکروسکوپ فلورسانس برای مدل‌سازی زیستی کواین مایکروسافت ریسرچ

مدل Quine مایکروسافت جست‌وجوی داروهای سرطان پانکراس را به یک آخر هفته رساند

مایکروسافت مدل چندوجهی Quine را معرفی کرد که با شبیه‌سازی سیستم‌های بیولوژیک، هزاران ترکیب شیمیایی را برای درمان سرطان پانکراس غربال می‌کند. این سیستم توانست در یک آخر هفته، لیستی…

۵ دقیقه خواندن۱
اثر مشاهده‌گر در پایش زنجیره تفکر: تأثیر نظارت بر استدلال مدل‌های زبانی بزرگ
آموزش کاربردی

چرا نظارت بر زنجیرهٔ افکار، رفتار عامل‌های هوشمند را تغییر می‌دهد؟

ثبت گزارش‌های استدلالی در عامل‌های هوش مصنوعی، اثر مشاهده‌گری ایجاد می‌کند و نحوه حل مسئله توسط مدل را تغییر می‌دهد. توسعه‌دهندگان برای حفظ اصالت رفتار مدل، باید به‌جای درخواست…

۳ دقیقه خواندن