پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۸۸ مقاله منتشر شده

مدل‌های مرزی با تجهیزات ما به ~۹۹٪ در ARC-AGI-3 عمومی دست یافتند — شماتیک
آموزش کاربردی

سامانه Schema دقت مدل‌های هوش مصنوعی در بنچمارک ARC-AGI-3 را به ۹۹٪ رساند

یک چارچوب عامل‌محور جدید به نام Schema با تبدیل جهان به برنامه‌های قابل اجرا، مدل‌های پیشرو را به کارایی انسانی در حل مسائل پیچیده استدلالی رسانده است. این سیستم با جداسازی فرآیند…

۲۰ دقیقه خواندن
دستم هدفم را تعیین می‌کند: پرتابی که مسیر زندگی‌ام را رقم می‌زند.

برنامه‌ریزی پیش‌دستانه در برابر توجیه‌های لحظه‌ای در مدل‌های زبانی

تحلیل رفتار مدل‌های زبانی نشان می‌دهد که تفاوت عمیقی میان فرآیند تصمیم‌گیری داخلی و توضیحات بیرونی آن‌ها وجود دارد. در حالی که مدل‌هایی مثل Claude قادر به برنامه‌ریزی پیش‌دستانه…

۹ دقیقه خواندن۱
راهنمای مهندسی سیستم‌های عامل‌محور برای مدیریت پرس‌وجوهای بزرگ در محیط‌های توزیع‌شده
آموزش کاربردی

سامانه‌های توزیع‌شدهٔ عامل‌محور زمان پرس‌وجوهای حجیم را از ۴۰ دقیقه به ۹۰ ثانیه

تغیری بنیادین در معماری هوش مصنوعی، دستیاران یکپارچه را با سامانه‌ای چهارلایه جایگزین کرده تا پرس‌وجوهای در مقیاس پتابایت را مدیریت کند. این رویکرد با تجزیهٔ درخواست‌های پیچیده به…

۲۳ دقیقه خواندن
راهنمای فنی مدل زبانی کم‌تأخیر برای پیش‌بینی سری زمانی
آموزش کاربردی

قیمت‌گذاری تخت Oxlo.ai هزینه پیش‌بینی سری‌های زمانی با LLM را کاهش داد

زیرساخت جدید Oxlo.ai با حذف «راه‌اندازی سرد» و تغییر مدل هزینه از توکن به هر درخواست، تأخیر در پیش‌بینی داده‌های عددی را می‌گیرد. این رویکرد اجازه می‌دهد مدل‌های زبانی جایگزین…

۵ دقیقه خواندن
هکر هوش مصنوعی GPT-Red شرکت OpenAI برای افزایش امنیت مدل‌ها ساخته شد.

«اتوماسیون Red-Teaming»؛ راهکار جدید OpenAI برای شناسایی حفره‌های امنیتی

اوپن‌ای‌آی مدل تخصصی GPT-Red را برای شناسایی و رفع خودکار حفره‌های امنیتی مدل‌های دیگر توسعه داده است. این سیستم با استفاده از یک حلقه «بازی با خود»، استواری GPT-5.6 را به‌طوری…

۵ دقیقه خواندن۱