پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۱۱۱ مقاله منتشر شده

آرگوس‌رد — اسکن امنیتی و تست نفوذ · آرگوس‌رد
آموزش کاربردی

ArgusRed با مدل‌های تخصصی تهاجمی، حفره‌های امنیتی را به‌جای حدس، اثبات می‌کند

شرکت Cosine ابزاری به نام ArgusRed معرفی کرد که با استفاده از یک مدل زبانی تخصصی در امنیت تهاجمی، به‌جای گزارش ریسک‌های تئوریک، اکسپلویت‌های واقعی را بازتولید می‌کند. این ابزار با…

۶ دقیقه خواندن
ربات چت‌جی‌پی‌تی را مثل کامپایلر، نه معلم، استفاده می‌کنم!
آموزش کاربردیتأییدنشده · منبع منفرد

استدلال فعال در برابر مصرف غیرفعال کد در تعامل با مدل‌های زبانی

تغییر نقش ChatGPT از یک معلم به یک سیستم اعتبارسنج منطق، باعث بازگشت غریزه‌ی حل مسئله در برنامه‌نویسان می‌شود. این متد تمرکز را از مصرف غیرفعال کد به استدلال فعال و عیب‌یابی منتقل…

۲ دقیقه خواندن
عامل بدون آموزش انویدیا که کد را به‌عنوان رابط عملیاتی برای استدلال مکانی به کار می‌برد

رابط کد-محور در برابر فراخوانی صلب ابزار در مدل‌های بینایی-زبانی

انویدیا چارچوب SpatialClaw را معرفی کرد که به‌جای فراخوانی‌های صلب ابزار، از کد پایتون به‌عنوان رابط اقدام استفاده می‌کند. این رویکرد باعث شد مدل‌های بینایی-زبانی بدون نیاز به…

۵ دقیقه خواندن
۴۹۴ سیکل یاد گرفتم: نیت، عمل نیست؛ فراخوانی ابزار است.
آموزش کاربردی

چرا توصیفِ انجامِ وظیفه توسط عامل‌های هوش مصنوعی به خروجی منجر نمی‌شود؟

عامل‌های خودگردان در تله‌ای می‌افتند که توصیفِ انجام یک وظیفه را با اجرای واقعی آن اشتباه می‌گیرند. این نقص ساختاری باعث ایجاد حلقه‌های بی‌پایان از تفکر داخلی بدون هرگونه خروجی…

۱ دقیقه خواندن
تصویری از یک ربات در حال تلاش برای حل پازل پیچیده، نماد چالش هوش مصنوعی در کارهای دانشی واقعی.

فقط ۳٪ از وظایف پیچیده اداری توسط پیشرفته‌ترین مدل‌های هوش مصنوعی حل شد

محک جدید AA-Briefcase نشان می‌دهد حتی قدرتمندترین مدل‌های زبانی در مواجهه با پروژه‌های چند هفته‌ای و داده‌های پراکنده شکست می‌خورند. در حالی که Claude Fable 5 پیشتاز است، نرخ شکست…

۱ دقیقه خواندن۱
هوش مصنوعی وقتی نتایج جستجوی خود را نادیده می‌گیرد: ضرورت حفظ باورها

شکاف باور در Gemini 3.5 Flash؛ وقتی داده‌های قدیمی بر واقعیت‌های لحظه‌ای غلبه

تحلیلی فنی روی مدل Gemini 3.5 Flash نشان می‌دهد که این مدل در شرایط خاص، نتایج جست‌وجوی لحظه‌ای را نادیده گرفته و به داده‌های قدیمی آموزش خود باز می‌گردد. این «شکاف باور» ریسکی…

۹ دقیقه خواندن۱
اقتصاد جدید هوش مصنوعی بر پایه توکن‌ها بنا شده، اما ما آن‌ها را اشتباه می‌سنجیم.

حجم توکن در برابر معماری سیستم؛ تضاد در سنجش هوشمندی تجاری

صنعت AI از شمارش درخواست‌ها به سمت توکن‌ها حرکت کرده، اما کارشناسان هشدار می‌دهند که حجم توکن را نباید با هوشمندی یا درآمد یکی دانست. ارزش واقعی در معماری سیستم، به‌ویژه مدیریت…

۷ دقیقه خواندن
راهنمای گام‌به‌گام استقرار مدل‌های زبانی بزرگ
آموزش کاربردی

Oxlo.ai با مدل قیمت‌گذاری درخواستی هزینه استنتاج LLM را تثبیت کرد

پلتفرم Oxlo.ai مدل قیمت‌گذاری مبتنی بر توکن را با مدل «درخواست‌محور» جایگزین کرد تا هزینه‌های عملیاتی در گردش‌های کاری پیچیده پیش‌بینی‌پذیر شود. این رویکرد تفاوت میان هزینه پردازش…

۵ دقیقه خواندن
فراخوانی ابزار مبتنی بر پرامپت برای مدل‌های زبانی سبک متن‌باز
آموزش کاربردی

«از مخزن دانش به کنترل‌کننده»؛ رویکرد جدید در مدیریت ابزارهای خارجی AI

پژوهشی جدید در AIS2C2 ۲۰۲۵ چارچوبی را معرفی می‌کند که به مدل‌های زبانی کوچک و بازمتن اجازه می‌دهد از طریق پرامپت‌های ساختاریافته از ابزارهای خارجی استفاده کنند. این روش نیاز به…

۲ دقیقه خواندن
RAG عامل‌محور فقط تکمیل خودکار پیشرفته نیست؛ یک چالش زیرساختی کاملاً جدید است.
آموزش کاربردی

تولید بازیابی‌افزای عامل‌محور؛ چالشی در زیرساخت‌های توزیع‌شده به‌جای مهندسی

گذار از RAG استاندارد به سیستم‌های عامل‌محور، هوش مصنوعی را از یک «کتابدار» به «مدیر پروژه» تبدیل می‌کند. این تغییر، موانع زیرساختی جدی از جمله پیچیدگی مسیریابی ابزارها و جهش‌های…

۴ دقیقه خواندن۲