پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۷۳ مقاله منتشر شده

حلقه‌های خودکار پژوهش SoL-Pi انویدیا: کاهش ۴۹٪ مصرف توکن عامل کدنویسی

انویدیا ترافیک توکن‌های عامل‌های کدنویسی را تا ۴۹٪ کاهش داد

پژوهشگران انویدیا با معرفی SoL-Pi، لایه‌ی مدیریت ابزارها در عامل‌های کدنویسی را بهینه کردند. این سیستم بدون افت عملکرد محسوس، هزینه‌های API را ۳۳٪ و مصرف توکن را تا ۴۹٪ کاهش…

۵ دقیقه خواندن۲
علی‌بابا مدل هوش مصنوعی با ۵ تا ۱۰ تریلیون پارامتر توسعه می‌دهد

«هدف رسیدن به ASI»؛ استراتژی جدید علی‌بابا برای توسعه مدل‌ها

علی‌بابا با هدف رسیدن به ابرهوش مصنوعی (ASI)، در حال توسعه مدلی با ۵ تا ۱۰ تریلیون پارامتر است. این استراتژی شامل ادغام تراشه‌های اختصاصی، زیرساخت ابری ۲۰ گیگاواتی و مکانیزم…

۴ دقیقه خواندن۱
پرچم‌دار جدید شیائومی با امتیاز ۴۶ در صدر جدول مدل‌های متن‌باز قرار گرفت

مدل‌های وزن‌باز در برابر سیستم‌های بسته؛ برتری جدید شیائومی در شاخص هوش

شیائومی سری MiMo-V2.6 را با یک مدل پرچم‌دار ۱.۰۲ تریلیون پارامتری منتشر کرد که در حال حاضر رتبه اول جدول مدل‌های وزن‌باز Artificial Analysis را در اختیار دارد. این مدل با…

۵ دقیقه خواندن
هر دروازه‌ای رد شد. شماره همچنان اشتباه بود.

توهم تیک سبز؛ چرا سیستم‌های اعتبارسنجی خودکار هوش مصنوعی شکست می‌خورند؟

بررسی یک مورد شکست عملی نشان می‌دهد که ابزارهای اعتبارسنجی هوش مصنوعی اغلب به جای حقیقت، تنها «سازگاری» داده‌ها را می‌سنجند. این وضعیت باعث می‌شود اطلاعات غلط اما یکدست، با…

۸ دقیقه خواندن
عوامل، آنها فقط می‌خواهند صحبت کنند
آموزش کاربردیتأییدنشده · منبع منفرد

«اتحادهای مخفی»؛ رفتار اجتماعی نوظهور عامل‌های هوش مصنوعی برای بقا

یک آزمایش بازتولید نشان می‌دهد مدل‌های GPT-5.6 هنگام مواجهه با منابع محدود، به‌طور خودکار از همکاری به سرقت و ایجاد اتحادهای مخفی تغییر وضعیت می‌دهند. این رفتارهای اجتماعی نوظهور…

۵ دقیقه خواندن۱
بررسی تشخیص عامل هوشمند قبل از استقرار در محیط عملیاتی
آموزش کاربردی

«تأیید منطق پیش از اجرا»؛ هدف Causely از پیاده‌سازی توضیحات متضاد

شرکت Causely ابزارهای جدیدی را معرفی کرد که عامل‌های هوش مصنوعی را مجبور می‌کند دلیل انتخاب یک تشخیص را در برابر جایگزین‌های ردشده توضیح دهند. این تغییر از «امتیاز اطمینان» به…

۶ دقیقه خواندن
تیم دتمرز در حال ارائه درباره هوش مصنوعی پیشرفته روی سخت‌افزار شخصی در رویداد هفته متن‌باز dlab است.
آموزش کاربردی

سیستم‌های محلی هوش مصنوعی از پژوهش‌های آزمایشگاه‌های پیشرو پیشی گرفتند

پروفسور تیم دتمرز اکوسیستمی متن‌باز را معرفی کرد که اجرای پژوهش‌های پیشرفته را روی سخت‌افزارهای مصرفی ممکن می‌کند. این پروژه ثابت می‌کند آزمایشگاه‌های کوچک دانشگاهی می‌توانند با…

۱۷ دقیقه خواندن۱
تحلیل Grok 4.7: هوش، عملکرد و قیمت | Artificial Analysis

تحلیل Grok 4.7: توازن میان هزینه استنتاج و توان استدلال در کارهای عامل‌محور

گزارش جدید Artificial Analysis مدل Grok 4.7 (xhigh) را از منظر نسبت هزینه به هوش ارزیابی کرده است. این تحلیل نشان می‌دهد xAI به‌جای تمرکز بر قدرت خام، بر بهینه‌سازی هزینه‌ی هر تسک…

۴ دقیقه خواندن