پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۸۷ مقاله منتشر شده

عصر دیجیتال را بر پایه‌ای ساختیم که هنوز کاملاً نمی‌فهمیم. هوش مصنوعی هم همین‌طور است.

رویکرد آزمایشگاه بل: چرا ساخت ابزارهای هوش مصنوعی پیش از درک کامل آن‌ها حیاتی

مقایسه اختراع ترانزیستور با ظهور هوش مصنوعی نشان می‌دهد که پیشرفت تمدنی نیازمند درک تئوریک کامل نیست. پیروزی در عصر جدید متعلق به «سازندگانی» است که در عین ابهام، بر تکرار و ساخت…

۶ دقیقه خواندن۱
هوش مصنوعی هفته: پرامپت کردن یک صفحه گسترده - نگاهی به TabFM گوگل برای داده‌های جدولی

«حذف تنظیم ابرپارامترها»؛ رویکرد جدید TabFM برای تحلیل داده‌های جدولی

گوگل مدل بنیادی TabFM را معرفی کرد که پیش‌بینی داده‌های جدولی را از طریق یادگیری در بستر متن انجام می‌دهد. این مدل نیاز به مهندسی ویژگی‌های دستی و تنظیم ابرپارامترها را با تبدیل…

۲ دقیقه خواندن
استدلال درست بود، اما جهان تغییر کرد
آموزش کاربردی

مکانیزم State-Binding اثرات مخرب داده‌های قدیمی در عامل‌های هوش مصنوعی را حذف

عامل‌های هوش مصنوعی اغلب بر اساس داده‌های منقضا شده تصمیم می‌گیرند که منجر به اقدامات نادرست در محیط‌های پویا می‌شود. روش State-Binding با الزام عامل به پیوستن یک مرجع وضعیت به هر…

۶ دقیقه خواندن۱
انتشار Audex توسط انویدیا: مدل زبانی یکپارچه صدا-متن با حفظ هوشمتدی متنی مدل پایه

مدل Audex انویدیا دلیل افت استدلال متنی در سیستم‌های چندوجهی را حل کرد

انویدیا مدل Audex را معرفی کرد؛ یک مدل ۳۰ میلیارد پارامتری که بدون کاهش توان استدلالی، صوت و متن را پردازش می‌کند. این مدل یکی از معدود مدل‌های وزن‌باز است که می‌تواند صداهای…

۵ دقیقه خواندن۲
هوش مصنوعی فراتر از گفتگو: چگونه آن را واقعاً به کار بگیریم
آموزش کاربردی

چگونه چرخهٔ ReAct هوش مصنوعی را از گفتگو به اجرای عملیاتی می‌برد؟

هوش مصنوعی عامل‌محور با جایگزینی پاسخ‌های متنی با چرخه «تفکر-عمل-مشاهده»، اهداف پیچیده را به‌طور خودکار اجرا می‌کند. این سیستم‌ها با استفاده از چارچوب ReAct قادرند خطاها را در…

۱۰ دقیقه خواندن۱
هوش رویه‌ای هوش مصنوعی حقوقی: تضمین یکپارچگی زمینه‌ای با A2JRAG و نمودار وضعیت
آموزش کاربردی

Lawmadi OS با گراف‌های وضعیت، مسیر دادرسی‌های حقوقی را نقشه‌برداری می‌کند

سامانه Lawmadi OS چارچوب تخصصی A2JRAG را برای ردیابی دقیق مراحل قانونی کاربر معرفی کرد. این سیستم با تطبیق آنی داده‌ها با پایگاه‌های دولتی، از ارائه توصیه‌های خارج از بافت زمانی و…

۱ دقیقه خواندن
ساخت سیستم‌های هوش مصنوعی که *احساس* تفکر می‌دهند
آموزش کاربردی

معماری سه لایه برای شبیه‌سازی آگاهی در عامل‌های هوش مصنوعی

یک چارچوب معماری جدید نشان می‌دهد که چگونه می‌توان با پیاده‌سازی حافظه پایدار، امتیازدهی به اطمینان و تعقیب اهداف خودمختار، از چت‌بات‌های واکنشی فراتر رفت. این سازوکارها به…

۸ دقیقه خواندن
نمودار مقایسه عملکرد عوامل کدنویسی هوش مصنوعی در مهندسی نرم‌افزار واقعی

Claude Opus 4.8 با نرخ موفقیت ۲۶ درصدی در صدر بنچمارک SWE-Marathon قرار گرفت

محک جدید SWE-Marathon نشان می‌دهد پیشرفته‌ترین عامل‌های کدنویسی هنوز در پروژه‌های نرم‌افزاری عظیم شکست می‌خورند. Claude Opus 4.8 با موفقیت در ۲۶ درصد موارد، پیشتازی می‌کند اما…

۶ دقیقه خواندن۱
برنامه‌نویس عمل‌گرا در عصر هوش مصنوعی: بازخوانی یک کلاسیک
زندگی با AI

«جایگزینی تخصص با AI محال است»؛ بازنگری در مدل‌های ذهنی کدنویسی

تحلیل جدیدی از کتاب «برنامه‌نویس عمل‌گرا» نشان می‌دهد هوش مصنوعی جایگزین تخصص نمی‌شود، بلکه نیاز به مدل‌های ذهنی سطح بالا و معماری دقیق را افزایش می‌دهد. تمرکز مهندسی نرم‌افزار از…

۶ دقیقه خواندن
مدل‌های برتر هوش مصنوعی مقالات پس‌گرفته‌شده را استناد می‌دهند، بدون اینکه بدانند.

مدل‌های پیشرو هوش مصنوعی مقالات باطل‌شده را به‌عنوان سند معتبر می‌شناسند

تحلیل‌های جدید نشان می‌دهد مدل‌های زبانی بزرگ قادر به تشخیص ابطال مقالات علمی پس از تاریخ قطع آموزش خود نیستند. در حالی که مدل‌ها موارد قدیمی و مشهور را می‌شناسند، مقالات به‌تازگی…

۴ دقیقه خواندن
مقایسه API هوش مصنوعی سازمانی و استارتاپی: تست ۳۰ روزه یک دانشمند داده
آموزش کاربردی

استفاده از APIهای تجمیعی هزینه استنتاج هوش مصنوعی را ۹۴٪ کاهش داد

یک آزمایش ۳۰ روزه نشان می‌دهد مسیریابی ترافیک مدل‌ها از طریق تجمیع‌کننده‌هایی مانند Global API می‌تواند هزینه‌ها را تا ۹۴٪ نسبت به استفاده مستقیم از GPT-4o کاهش دهد. این مطالعه بر…

۷ دقیقه خواندن۱