پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۸۷ مقاله منتشر شده

طراحی عامل‌های تحلیل مالی مبتنی بر مهارت با Claude، پایتون، اتصال‌دهنده‌های MCP و تحویل‌دهی خودکار
آموزش کاربردی

چارچوب مهارت‌محور آنتروپیک تحلیل‌های مالی پیچیده را خودکار کرد

یک گردش‌کار فنی جدید معماری خدمات مالی آنتروپیک را در پایتون بازسازی می‌کند تا مدل‌های کلود بتوانند ارزیابی‌های DCF و تحلیل شرکت‌های مشابه را از طریق یک سامانه ثبت مهارت اجرا…

۱۰ دقیقه خواندن۱
عامل هوشمند با فشرده‌سازی زمینه: کاهش توهمات با حفظ ظرافت‌ها
آموزش کاربردی

تحقیق جدید: فشرده‌سازی بافت کاهش می‌دهد توهمات عامل‌های هوش مصنوعی را

تزریق حجم بالای داده به عامل‌های هوش مصنوعی اغلب باعث کاهش دقت و بروز اثر «گم‌شده در میانه» می‌شود. تکنیک‌های جدید فشرده‌سازی، از جمله بازرتبه‌بندی و خلاصه‌سازی بازگشتی، با حذف…

۸ دقیقه خواندن
لوگوی MAI-Cyber-1-Flash در کنار نام MDASH و مایکروسافت AI

«بهینه‌سازی ۹۰درصدی وظایف امنیتی»؛ دستاورد جدید مدل فشرده مایکروسافت

مایکروسافت مدل فشرده و کد-محور MAI-Cyber-1-Flash را برای مدیریت ۹۰٪ وظایف امنیتی عرضه کرد. این استراتژی هزینه عملیات را نصف کرده و دقت سیستم در شناسایی تهدیدات را افزایش داده است.

۳ دقیقه خواندن۱
عصر توسعه اپلیکیشن‌های هوش مصنوعی عامل‌محور: معماری، چارچوب‌ها و چرخه حیات مدرن نرم‌افزار
آموزش کاربردی

تغییر معماری نرم‌افزار از کدزدنی به ارکستراسیون عامل‌های هوش مصنوعی

توسعه نرم‌افزار از نوشتن کدهای ایستا به مدیریت عامل‌های خودمختار تغییر مسیر داده است. چارچوب‌های جدید با ایجاد چرخه «ادراک-استدلال-عمل-تأمل»، امکان خوداصلاحی برنامه‌ها و اجرای…

۳ دقیقه خواندن
معیار جدید METR برای محاسبه دقیق زمان گران‌تر شدن عامل‌های هوش مصنوعی از انسان‌ها

سقف هزینه‌ای ۳۳۰۰ دلاری؛ نقطهٔ شکست عامل‌های هوش مصنوعی در برابر انسان

سازمان پژوهشی METR با معرفی معیار «افق هزینه»، نشان داد که عامل‌های فعلی هوش مصنوعی در پروژه‌های پیچیده، پس از صرف چند هزار دلار، دیگر بازدهی اقتصادی ندارند. این داده‌ها حاکی از…

۵ دقیقه خواندن۳
مسیر دستیابی به ابرهوش مصنوعی

معماری افقی؛ راهکار Outshift برای عبور از شکست سامانه‌های چندعاملی

سامانه‌های فعلی هوش مصنوعی با وجود قدرت استدلال بالا، در همکاری تیمی شکست می‌خورند. Outshift با معرفی «اینترنت شناخت»، لایه‌ای برای اشتراک اهداف و حافظه میان عامل‌ها ایجاد کرده تا…

۶ دقیقه خواندن
ساخت سیستم‌های خودران: از قوانین تا یادگیری تقویتی
آموزش کاربردی

یادگیری تقویتی در برابر منطق صلب برای حل مسائل تصمیم‌گیری متوالی

سامانه‌های خودمختار برای مدیریت تصمیمات پیچیده و متوالی، از منطق صلبِ قانون‌محور به سمت یادگیری تقویتی حرکت می‌کنند. با این حال، «شکاف واقعیت» و دشواری تأیید ایمنی همچنان موانع…

۶ دقیقه خواندن۱
توکن‌ها واحد اندازه‌گیری نیستند
آموزش کاربردی

پرداخت به ازای نتیجه در برابر هزینهٔ توکنی در مدل‌های زبانی

بررسی هزینه‌های استنتاج نشان می‌دهد «توکن‌های استدلالی» پنهان در مدل‌های ارزان، قیمت واقعی آن‌ها را تا ۱۴.۷ برابر بیشتر از نرخ اعلام‌شده می‌کند. راهکار جایگزین، تغییر مدل…

۱۱ دقیقه خواندن۱
هجوم عامل‌های Cursor: مدل‌های ارزان‌تر با برنامه‌ریزی مدل‌های پیشرو، بیشتر کدنویسی را انجام می‌دهند

«توزیع بار شناختی»؛ استراتژی Cursor برای حذف توهمات کدنویسی

شرکت Cursor با جداسازی نقش برنامه‌ریز و مجری در یک ساختار «سرمایه‌ای»، حجم کدها را بدون کاهش کیفیت به‌شدت پایین آورد. این رویکرد با توزیع بار شناختی بین مدل‌های پیشرو و مدل‌های…

۵ دقیقه خواندن
نمودار رویکرد ساختاریافته حل مسئله با هوش مصنوعی: ناظر و همدست
آموزش کاربردی

تفکیک نقش «ناظر» و «همدست»؛ متد جدید QuackBuilds برای کاهش خطای کدنویسی AI

شرکت QuackBuilds با معرفی یک قالب پرامپت ساختاریافته، فرآیند حل مسئله در هوش مصنوعی را به دو مرحله تحلیل استراتژیک و اجرای فنی تقسیم کرده است. این رویکرد با اجبار مدل به بازبینی…

۱ دقیقه خواندن