پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۱۱۶ مقاله منتشر شده

نمودار مقایسه عملکرد عوامل کدنویسی هوش مصنوعی در مهندسی نرم‌افزار واقعی

Claude Opus 4.8 با نرخ موفقیت ۲۶ درصدی در صدر بنچمارک SWE-Marathon قرار گرفت

محک جدید SWE-Marathon نشان می‌دهد پیشرفته‌ترین عامل‌های کدنویسی هنوز در پروژه‌های نرم‌افزاری عظیم شکست می‌خورند. Claude Opus 4.8 با موفقیت در ۲۶ درصد موارد، پیشتازی می‌کند اما…

۶ دقیقه خواندن
برنامه‌نویس عمل‌گرا در عصر هوش مصنوعی: بازخوانی یک کلاسیک
زندگی با AI

«جایگزینی تخصص با AI محال است»؛ بازنگری در مدل‌های ذهنی کدنویسی

تحلیل جدیدی از کتاب «برنامه‌نویس عمل‌گرا» نشان می‌دهد هوش مصنوعی جایگزین تخصص نمی‌شود، بلکه نیاز به مدل‌های ذهنی سطح بالا و معماری دقیق را افزایش می‌دهد. تمرکز مهندسی نرم‌افزار از…

۶ دقیقه خواندن
مدل‌های برتر هوش مصنوعی مقالات پس‌گرفته‌شده را استناد می‌دهند، بدون اینکه بدانند.

مدل‌های پیشرو هوش مصنوعی مقالات باطل‌شده را به‌عنوان سند معتبر می‌شناسند

تحلیل‌های جدید نشان می‌دهد مدل‌های زبانی بزرگ قادر به تشخیص ابطال مقالات علمی پس از تاریخ قطع آموزش خود نیستند. در حالی که مدل‌ها موارد قدیمی و مشهور را می‌شناسند، مقالات به‌تازگی…

۴ دقیقه خواندن
مقایسه API هوش مصنوعی سازمانی و استارتاپی: تست ۳۰ روزه یک دانشمند داده
آموزش کاربردی

استفاده از APIهای تجمیعی هزینه استنتاج هوش مصنوعی را ۹۴٪ کاهش داد

یک آزمایش ۳۰ روزه نشان می‌دهد مسیریابی ترافیک مدل‌ها از طریق تجمیع‌کننده‌هایی مانند Global API می‌تواند هزینه‌ها را تا ۹۴٪ نسبت به استفاده مستقیم از GPT-4o کاهش دهد. این مطالعه بر…

۷ دقیقه خواندن
ربات‌های خودران: مقایسه عملکرد با A11 و بدون A11
آموزش کاربردی

معماری A11: جایگزینی ساختار خطی ربات‌ها با سلسله‌مراتب تصمیم‌گیر

چارچوب A11 با معرفی لایه‌های «اراده» و «خرد»، ساختار خطی ربات‌های مدرن را به یک مدل تصمیم‌گیری عمودی تبدیل می‌کند. این تغییر اجازه می‌دهد ربات‌ها به‌جای اجرای صرف دستورات، تضادهای…

۳ دقیقه خواندن
مسیر عامل هوشمند و همگرایی: چرا مسیر در ارزیابی عامل‌های هوش مصنوعی اهمیت دارد
آموزش کاربردی

«همگرایی عامل‌ها»؛ معیار جدید برای افزایش بهره‌وری تولید

تمرکز توسعه‌دهندگان از بررسی صرفاً نتیجه‌ی نهایی به تحلیل «مسیر حرکت» یا تراژکتوری عامل‌های هوش مصنوعی تغییر کرده است. شناسایی مسیرهای ناکارآمد می‌تواند هزینه‌های API و زمان…

۴ دقیقه خواندن
ادغام مدل زبانی بزرگ با وظایف بینایی ماشین
آموزش کاربردی

Oxlo.ai هزینهٔ عامل‌های چندوجهی را با مدل قیمت‌گذاری درخواستی کاهش داد

ترکیب مدل‌های زبانی با بینایی ماشین باعث انفجار توکن‌ها و افزایش هزینه‌ها می‌شود. Oxlo.ai با جایگزینی پرداخت توکنی با یک مدل قیمت‌گذاری ثابت برای هر درخواست، این چالش عملیاتی را…

۴ دقیقه خواندن
هوش مصنوعی چگونه پاسخ‌ها را پیدا می‌کند؟ هوشمندتر از آن است که فکر می‌کنید!
زندگی با AIتأییدنشده · منبع منفرد

تحلیل ترافیک شبکه: ChatGPT برای پاسخ به کاربر، منابع وب را با هم مقایسه می‌کند

بررسی فنی ترافیک شبکه ChatGPT نشان داد که این مدل صرفاً متن تولید نمی‌کند، بلکه مانند یک کارآگاه دیجیتال، چندین منبع وب را برای اعتبارسنجی اطلاعات با هم مقایسه می‌کند. این فرآیند…

۲ دقیقه خواندن