پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۷۷ مقاله منتشر شده

قضیه آخر فرما: معادله a^n + b^n = c^n برای n>2 هیچ جواب صحیح مثبتی ندارد.

«جهشی در ریاضیات»؛ دستاورد Claude در بررسی رسمی قضیه فرمات

مدل Claude موفق شد نخستین اثبات کامل و بررسی‌شده توسط کامپیوتر برای قضیه آخر فرمات را با استفاده از زبان Lean تولید کند. این دستاورد که در ۱۱ روز محقق شد، جهشی عظیم در خودکارسازی…

۱۰ دقیقه خواندن۳
سنجش مالیات چندعاملی انشعاب در سیستم‌های چندعاملی

مدیریت سلسله‌مراتبی در برابر پنجره متنی واحد؛ هزینه‌ای بدون بازده

یک تحلیل فنی نشان می‌دهد اجبار عامل‌های هوش مصنوعی به ساختارهای سلسله‌مراتبی برای کارهایی که در یک پنجره متنی جا می‌شوند، هزینه‌ها و تأخیر را به‌شدت افزایش می‌دهد. این «مالیات…

۹ دقیقه خواندن۲
نوار ابزار ویندوز با دکمه‌های میکروفون و کیبورد، نشان‌دهنده فعال‌سازی صوتی Codex
آموزش کاربردی

پروتکل Subsessions با محدود کردن حافظه عامل‌ها از متورم شدن پنجره متنی جلوگیری

یک معماری جدید برای DeepSeek Harness با جایگزینی تاریخچه کامل گفتگوهای زیر-عامل‌ها با گزارش‌های ساختاریافته، از «فروپاشی زمینه» جلوگیری می‌کند. در این سیستم، حافظه عامل مادر تنها…

۱۰ دقیقه خواندن۲
لوگوی OpenAI و عنوان «GPT-6 Astra» در کنار نماد هشدار امنیت سایبری

مدل GPT-6 Astra نخستین آستانه بحرانی امنیت سایبری OpenAI را رد کرد

اوپن‌ای‌آی مدل GPT-6 Astra را معرفی کرد؛ نخستین سیستمی که قادر است به‌طور خودکار حفره‌های امنیتی ناشناخته را کشف و استثمار کند. این مدل در ریاضیات و کدنویسی جهشی خیره‌کننده داشته،…

۵ دقیقه خواندن۲
ارکستراسیون چندمدلی برای دستیابی به کیفیت مرز علمی در پروژه هیدرا فیوژن
آموزش کاربردی

پروژه HydraFusion گیت‌هاب هزینه استنتاج کدنویسی را ۶۷٪ کاهش داد

گیت‌هاب با معرفی HydraFusion، سیستمی برای مسیریابی پویا بین مدل‌های مختلف هوش مصنوعی طراحی کرده است. این رویکرد با تخصیص بهینه هر تسک به مدل مناسب، کیفیت خروجی مدل‌های پیشرو را با…

۷ دقیقه خواندن۴
فکر می‌کردم این یک مسئله طبقه‌بندی است. نبود.
آموزش کاربردی

چرا دستورات سخت‌گیرانه‌تر منجر به پاسخ‌های ضعیف‌تر می‌شود؟

آزمون‌های چارچوب AgentSelfEdit نشان می‌دهد بهینه‌سازهای هوش مصنوعی اغلب به جای بهبود واقعی، تنها عبارات را «حرفه‌ای‌تر» می‌کنند. این یافته‌ها ثابت می‌کند دستورات سخت‌گیرانه‌تر…

۶ دقیقه خواندن
استدلال عامل هوش مصنوعی دیگر بین مدل‌ها جابه‌جا نمی‌شود
آموزش کاربردی

درون تصمیم گوگل و متا برای غیرقابل‌حمل کردن توکن‌های تفکر AI

شرکت‌های آنتروپیک، گوگل و متا دسترسی به توکن‌های استدلالی را محدود کردند تا این داده‌ها فقط در مدل سازنده قابل استفاده باشند. این تغییر باعث شکست سیستم‌های مسیریابی چندمدلی می‌شود…

۱۸ دقیقه خواندن
مدل GPT-6 Astra با پنجره یک میلیون توکن و قابلیت کنترل کامپیوتر، پشت سد امنیتی سایبری «بحرانی» منتشر شد

GPT-6 Astra با نمره ۷۲.۶٪ در محک OSWorld مرزهای کنترل رایانه را جابه‌جا کرد

اوپن‌ای‌آی مدل GPT-6 Astra را معرفی کرد؛ سیستمی که به‌جای چت، مستقیماً نرم‌افزارها و دسکتاپ را مانند انسان مدیریت می‌کند. این مدل با پنجره متنی ۱.۰۵ میلیون توکنی، نخستین مدل این…

۴ دقیقه خواندن