پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۱۱۶ مقاله منتشر شده

نمودار: طبقه‌بندی باگ‌های کد پایتون تولیدشده با هوش مصنوعی
آموزش کاربردی

BrassCoders توهمات ساختاری در کدهای پایتون را به‌صورت اتوماتیک حذف می‌کند

ابزار BrassCoders با طبقه‌بندی خطاها به ۸ دسته، توهمات ساختاری مانند کتابخانه‌های جعلی را پیش از اجرا شناسایی می‌کند. این رویکرد فشار بررسی دستی را کاهش داده و تنها خطاهای پیچیده…

۴ دقیقه خواندن
فضای کاری جهانی در مدل‌های زبانی: نمایش توزیع‌شده و پردازش موازی در مقابل یکپارچگی متمرکز و تفکیک‌پذیری ساختاری

کشف «فضای J» در مدل کلاود؛ ساختار عصبی برای تفکیک تفکر خصوصی از پاسخ نهایی

پژوهشگران آنتروپیک ساختاری spontaneous در مدل کلاود یافتند که مانند یک فضای کار ذهنی عمل می‌کند. این لایه به مدل اجازه می‌دهد پیش از تولید پاسخ، به‌صورت بی‌صدا استدلال کرده و…

۲۳ دقیقه خواندن
راهنمای توسعه‌دهندگان برای صرفه‌جویی در هزینه API کلود کد
آموزش کاربردی

بررسی‌های Claude Code: مدیریت بستر متن هزینه‌های API را به‌شدت کاهش می‌دهد

بررسی‌های جدید نشان می‌دهد بسیاری از برنامه‌نویسان به‌دلیل عادت‌های ناکارآمد و حجیم کردن بستر متن، سهمیه استفاده از Claude Code را به‌سرعت می‌سوزانند. با اجرای تکنیک‌های…

۲۱ دقیقه خواندن
مدل متن‌باز Hy3 تنسنت با اندازه فعال یک‌پنجم، عملکردی مشابه مدل‌های بزرگ‌تر دارد.

معماری ترکیبی Hy3 در برابر مدل‌های حجیم؛ برابری عملکرد با حجم کمتر

تنسنت مدل متن‌باز Hy3 را معرفی کرد؛ معماری ترکیبی خبره‌ها که با پارامترهای فعال کمتر، عملکردی برابر با مدل‌های غول‌آسای صنعت دارد. این مدل هم‌اکنون در اکوسیستم وی‌چت ادغام شده است.

۱ دقیقه خواندن
بازیابی حافظه نیست: ساخت لایه استدلال برای هوش مصنوعی
آموزش کاربردی

Sonn با لایه‌ی استدلال، بازیابی غیرفعال هوش مصنوعی را جایگزین کرد

پلتفرم Sonn با معرفی یک لایه‌ی استدلالی، از مدل RAG سنتی فراتر رفته تا رفتار عامل‌های هوش مصنوعی را به‌جای بازیابی ساده‌ی متن، به‌صورت فعال هدایت کند. این سیستم با تزریق راهنماهای…

۴ دقیقه خواندن
بازگشت به میانگین: درباره مدل‌های زبانی بزرگ و مرگ خاموش نوآوری
زندگی با AI

مدل‌های زبانی بزرگ ایده‌های نو را به عنوان خطا شناس می‌کنند

ساختار احتمالات در مدل‌های زبانی بزرگ باعث می‌شود این سامانه‌ها به‌جای خلق ایده‌های بدیع، به سمت «میانگین» داده‌ها حرکت کنند. این پدیده باعث تبدیل نوآوری‌های واقعی به خطاهایی…

۳ دقیقه خواندن
اسکنر نشت ساختم، بعد دقیقاً محل شکستش را اندازه گرفتم. هر دو را اینجا می‌بینید.
آموزش کاربردی

آشنایی با AgentLeak: نشت داده‌های حساس از طریق زنجیره تفکر عامل‌های هوش مصنوعی

یک ابزار شناسایی نشت داده فاش کرد که عامل‌های هوش مصنوعی حتی در صورت فیلتر بودن خروجی نهایی، اطلاعات حساس را در مسیرهای استدلالی داخلی خود لو می‌دهند. این آسیب‌پذیری پیش از این…

۲ دقیقه خواندن
آموزش Gemma-3 برای استدلال ریاضی ساختاریافته با Tunix GRPO، آداپتورهای LoRA و پاداش‌های GSM8K
آموزش کاربردی

«تبدیل مدل عمومی به عامل منطقی»؛ دستاورد جدید در تنظیم دقیق Gemma-3

یک گردش‌کار فنی جدید نشان می‌دهد چگونه می‌توان مدل Gemma-3 گوگل را با استفاده از بهینه‌سازی سیاست نسبی گروهی (GRPO) و آداپتورهای لورا برای ریاضیات تنظیم دقیق کرد. این فرآیند یک…

۸ دقیقه خواندن