پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۸۹ مقاله منتشر شده

کلید API اوپن‌ای‌ای رایگان است، اما استفاده از آن رایگان نیست.

هزینه‌ی پنهان پرگویی؛ چرا قیمت ارزان توکن‌های Kimi K3 گمراه‌کننده است؟

مدل Kimi K3 با ۲.۸ تریلیون پارامتر و پنجره زمینه یک میلیون توکنی معرفی شد، اما تمایل شدید به تولید پاسخ‌های طولانی (Verbosity) ممکن است هزینه‌ی نهایی هر تسک را دو برابر کند. در…

۸ دقیقه خواندن
تحلیل هوش، عملکرد و قیمت کیمی K3

Kimi K3: مدل استدلالی جدید با امتیاز ۵۷ در شاخص هوشمند Artificial Analysis

مدل K3 با ۲.۸ تریلیون پارامتر و پنجره متنی یک میلیون توکنی معرفی شد. این مدل در زمینه هوش استدلالی به‌طور قابل‌توجهی از میانگین مدل‌های هم‌رده پیشی گرفته، اما در سرعت تولید خروجی…

۲ دقیقه خواندن
تحلیل ارائه‌دهندگان مدل و API هوش مصنوعی | تحلیل هوش مصنوعی

Artificial Analysis: سنجش ارزش اقتصادی مدل‌ها جایگزین امتیازات کلی شد

پلتفرم Artificial Analysis مجموعه‌ای از محک‌های جدید برای ارزیابی گردش‌های کاری پیچیده و نرخ توهم در مدل‌های پیشرو معرفی کرد. این چارچوب‌ها به جای امتیازات کلی، ارزش اقتصادی واقعی…

۱ دقیقه خواندن۱
مدل‌های مرزی با تجهیزات ما به ~۹۹٪ در ARC-AGI-3 عمومی دست یافتند — شماتیک
آموزش کاربردی

سامانه Schema دقت مدل‌های هوش مصنوعی در بنچمارک ARC-AGI-3 را به ۹۹٪ رساند

یک چارچوب عامل‌محور جدید به نام Schema با تبدیل جهان به برنامه‌های قابل اجرا، مدل‌های پیشرو را به کارایی انسانی در حل مسائل پیچیده استدلالی رسانده است. این سیستم با جداسازی فرآیند…

۲۰ دقیقه خواندن
دستم هدفم را تعیین می‌کند: پرتابی که مسیر زندگی‌ام را رقم می‌زند.

برنامه‌ریزی پیش‌دستانه در برابر توجیه‌های لحظه‌ای در مدل‌های زبانی

تحلیل رفتار مدل‌های زبانی نشان می‌دهد که تفاوت عمیقی میان فرآیند تصمیم‌گیری داخلی و توضیحات بیرونی آن‌ها وجود دارد. در حالی که مدل‌هایی مثل Claude قادر به برنامه‌ریزی پیش‌دستانه…

۹ دقیقه خواندن۱