پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۸۹ مقاله منتشر شده

نمودار روش‌های تفسیرپذیری مدل‌های زبانی بزرگ: دسته‌بندی و مقایسه تکنیک‌های مختلف
آموزش کاربردی

تفسیرپذیری مدل‌های جعبه‌سیاه با مکانیزم پرامپت‌نویسی متضاد

یک اسکنر جدید به مهندسان اجازه می‌دهد بدون دسترسی به وزن‌های داخلی، رفتار مدل‌های زبانی را از طریق مقایسه پاسخ‌های پایه با تغییرات متضاد تحلیل کنند. این گردش‌کار با استفاده از…

۵ دقیقه خواندن۱
طراحی عامل‌های تحلیل مالی مبتنی بر مهارت با Claude، پایتون، اتصال‌دهنده‌های MCP و تحویل‌دهی خودکار
آموزش کاربردی

چارچوب مهارت‌محور آنتروپیک تحلیل‌های مالی پیچیده را خودکار کرد

یک گردش‌کار فنی جدید معماری خدمات مالی آنتروپیک را در پایتون بازسازی می‌کند تا مدل‌های کلود بتوانند ارزیابی‌های DCF و تحلیل شرکت‌های مشابه را از طریق یک سامانه ثبت مهارت اجرا…

۱۰ دقیقه خواندن۱
عامل هوشمند با فشرده‌سازی زمینه: کاهش توهمات با حفظ ظرافت‌ها
آموزش کاربردی

تحقیق جدید: فشرده‌سازی بافت کاهش می‌دهد توهمات عامل‌های هوش مصنوعی را

تزریق حجم بالای داده به عامل‌های هوش مصنوعی اغلب باعث کاهش دقت و بروز اثر «گم‌شده در میانه» می‌شود. تکنیک‌های جدید فشرده‌سازی، از جمله بازرتبه‌بندی و خلاصه‌سازی بازگشتی، با حذف…

۸ دقیقه خواندن۲
لوگوی MAI-Cyber-1-Flash در کنار نام MDASH و مایکروسافت AI

«بهینه‌سازی ۹۰درصدی وظایف امنیتی»؛ دستاورد جدید مدل فشرده مایکروسافت

مایکروسافت مدل فشرده و کد-محور MAI-Cyber-1-Flash را برای مدیریت ۹۰٪ وظایف امنیتی عرضه کرد. این استراتژی هزینه عملیات را نصف کرده و دقت سیستم در شناسایی تهدیدات را افزایش داده است.

۳ دقیقه خواندن۱
عصر توسعه اپلیکیشن‌های هوش مصنوعی عامل‌محور: معماری، چارچوب‌ها و چرخه حیات مدرن نرم‌افزار
آموزش کاربردی

تغییر معماری نرم‌افزار از کدزدنی به ارکستراسیون عامل‌های هوش مصنوعی

توسعه نرم‌افزار از نوشتن کدهای ایستا به مدیریت عامل‌های خودمختار تغییر مسیر داده است. چارچوب‌های جدید با ایجاد چرخه «ادراک-استدلال-عمل-تأمل»، امکان خوداصلاحی برنامه‌ها و اجرای…

۳ دقیقه خواندن
معیار جدید METR برای محاسبه دقیق زمان گران‌تر شدن عامل‌های هوش مصنوعی از انسان‌ها

سقف هزینه‌ای ۳۳۰۰ دلاری؛ نقطهٔ شکست عامل‌های هوش مصنوعی در برابر انسان

سازمان پژوهشی METR با معرفی معیار «افق هزینه»، نشان داد که عامل‌های فعلی هوش مصنوعی در پروژه‌های پیچیده، پس از صرف چند هزار دلار، دیگر بازدهی اقتصادی ندارند. این داده‌ها حاکی از…

۵ دقیقه خواندن۳