پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۷۷ مقاله منتشر شده

شکل ۱: بنیان‌های زیستی یادگیری تقویتی و قانون اثر تورندایک (۱۸۹۸–۱۹۴۹)
آموزش کاربردی

ریشه‌های بیولوژیک یادگیری تقویتی؛ از جعبه‌های ثورندایک تا شبکه‌های عصبی

یادگیری تقویتی مدرن بر پایه حلقه‌های رفتاری است که روان‌شناسان بین سال‌های ۱۸۹۸ تا ۱۹۴۹ کشف کردند. مفاهیمی چون پاداش، ارزش و وزن‌ها، دهه‌ها پیش از ظهور اولین پردازنده‌های گرافیکی…

۱۳ دقیقه خواندن۲
نسخه ۱.۳ موز اسپارک: هوش مصنوعی خلاق برای تولید محتوا با سرعت و کیفیت بالاتر

مدل Muse Spark 1.3 متا مصرف توکن‌ها در کدهای پیچیده را ۲۵٪ کاهش داد

متا مدل Muse Spark 1.3 را برای بهینه‌سازی گردش‌های کاری عامل‌محور و وظایف مهندسی منتشر کرد. این به‌روزرسانی با کاهش چشمگیر توکن‌ها و فراخوانی ابزارها، پایداری مدل در اجرای دستورات…

۴ دقیقه خواندن۱
ریاضیدانان روس به مدل‌های هوش مصنوعی آموختند بدون کلام با هم گفتگو کنند

تبادل وزن‌ها در برابر تبادل متن؛ روشی ارزان‌تر برای اتصال مدل‌های AI

استارتاپ Mostik روشی را ابداع کرده که مدل‌های هوش مصنوعی به‌جای تبادل متن، از طریق مقادیر ریاضی وزن‌ها با یکدیگر ارتباط برقرار کنند. این تکنیک به مدل‌های کوچک اجازه می‌دهد هوشمندی…

۴ دقیقه خواندن۳
جمنای ۳.۸ فلش: سومین مدل اقتصادی گوگل در شش هفته، در حالی که مدل‌های پیشرو همچنان غایب‌اند

جمینای ۳.۸ فلش با امتیاز ۷۳.۷٪ در DeepSWE رقیب مدل‌های پیشرو شد

گوگل مدل اقتصادی Gemini 3.8 Flash را با عملکردی در سطح مدل‌های گران‌قیمت در کدنویسی و امنیت سایبری معرفی کرد. با وجود قیمت رقابتی، مصرف بالای توکن در استدلال‌های پیچیده ممکن است…

۴ دقیقه خواندن۱
نمی‌توانی آنچه را نمی‌توانی بررسی کنی، تفویض کنی.
آموزش کاربردی

پروتکل Agateon: جایگزینی شواهد ماشینی با اعتماد در عامل‌های هوش مصنوعی

گلوگاه اصلی عامل‌های هوش مصنوعی هوش مدل نیست، بلکه نبود سازوکار تأیید خروجی است. پروتکل Agateon با تبدیل تأیید به یک زیرساخت سخت‌گیرانه، «مالیات اعتماد» و نیاز به نظارت انسانی…

۶ دقیقه خواندن۲
تحلیل ویدیویی مبتنی بر عامل جدید گوگل جمینی، مصرف توکن را تا ۸۸ درصد کاهش می‌دهد

«جایگزینی نمونه‌برداری ثابت»؛ راهکار گوگل برای تحلیل بهینه ویدیوها

گوگل با جایگزینی نمونه‌برداری ثابت با رویکردی عامل‌محور، هزینه‌های تحلیل ویدیوهای طولانی را به‌شدت کاهش داد. این سیستم به‌جای اسکن تمام ثانیه‌ها، به‌صورت هوشمند تنها فریم‌ها و…

۳ دقیقه خواندن
ترجمه فارسی مختصر برای متن جایگزین تصویر:

"پرامپت AppSec که ساختم، ۴ شکاف امنیتی پیدا کرد"
آموزش کاربردی

قراردادهای سخت‌گیرانه در پرامپت؛ روشی برای شکار ۴ حفره امنیتی در کد باز

یک پژوهشگر امنیتی ثابت کرد که جایگزینی پرامپت‌های کلی با «قراردادهای سخت‌گیرانه»، توهمات هوش مصنوعی را حذف و منجر به شناسایی ۴ آسیب‌پذیری واقعی در مخازن متن‌باز می‌شود. این متد با…

۶ دقیقه خواندن
عذرخواهی آنتروپیک بابت قیود نامرئی کلود فیبل

کاهش ۴۵ درصدی هزینهٔ اجرای عامل‌های هوش مصنوعی در Claude Fable 5.1

آنتروپیک با معرفی نسخه‌های Fable 5.1 و Mythos 5.1، هزینه‌های گردش‌کارهای عامل‌محور را به‌شدت کاهش داد. این به‌روزرسانی بر بهبود استدلال علمی و بهینه‌سازی قیمت‌گذاری داده‌های…

۲ دقیقه خواندن۱