
آیا سامانه چندعاملی آنتروپیک گرهی از فرضیه ریمان گشود
یک مدل آزمایشی از شرکت آنتروپیک با استفاده از یک سامانه چندعاملی، موفق شد کران پایین راهکارهای فرضیه ریمان را افزایش دهد. این دستاورد حاصل بررسی ۶۵۰ ایده مختلف طی ۳۶ ساعت محاسبات…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۸۱ مقاله منتشر شده

یک مدل آزمایشی از شرکت آنتروپیک با استفاده از یک سامانه چندعاملی، موفق شد کران پایین راهکارهای فرضیه ریمان را افزایش دهد. این دستاورد حاصل بررسی ۶۵۰ ایده مختلف طی ۳۶ ساعت محاسبات…

استقرار مدلهای استدلالی عمیق بهدلیل گسترش توکنها در زنجیره تفکر، هزینههای غیرقابلپیشبینی ایجاد میکند. Oxlo.ai با جایگزینی صورتحساب توکنمحور با هزینه ثابت بهازای هر…

پیادهسازی جدید Oxlo.ai نشان میدهد چگونه میتوان از طبقهبندی سادهی تیکتها به سمت عاملهای استدلالی حرکت کرد. این سامانه با اجبار مدل به طی کردن زنجیرهی تفکر در قالب JSON، علت…

پژوهشگران امنیتی روشی برای استخراج متون رمزنگاریشدهی «زنجیره تفکر» از مدلهای تجاری یافتند. این آسیبپذیری منجر به افشای صدها راز خصوصی، از جمله کلیدهای API و رمزهای عبور شده…

موش سامبول از Lightrun استدلال میکند که مهندسی پرامپت برای ساخت عاملهای آمادهی تولید کافی نیست. او معماری «هدایت قطعی» را پیشنهاد میدهد که در آن اقدامات مدل توسط مشاهدهپذیری…

سیستم حافظه جدید ALTK-Evolve با جایگزینی «دفترچه راهنمای کامل» با «درسهای منتخب»، مصرف توکن را بهشدت کاهش میدهد. این رویکرد بدون افت دقت، هزینههای عملیاتی مدلهای قوی و ضعیف…

انویدیا مدل Nemotron-3.5-Lightning-30B را برای بهینهسازی عاملهای خودکار و استنتاج محلی عرضه کرد. این مدل با ترکیب معماری MoE و Mamba، پنجره متنی عظیم یک میلیون توکنی را روی…

مدل منتشرنشدهٔ Astra توانسته است ۱۰ مسئلهٔ پیچیده ریاضی را که دههها ریاضیدانان را به چالش کشیده بود، حل کند. این دستاورد در حالی رخ داده که بحثهای شدیدی دربارهٔ سرقت اعتبار علمی…

پژوهشگران آسیبپذیری جدیدی را کشف کردند که اجازه میدهد با استفاده از نسخههای کوچکتر مدلها، «افکار درونی» و زنجیره تفکر مدلهای قدرتمند رمزگشایی شود. این نقص امنیتی ریسک نشت…

سید علیرضا حسینی المدرسیه یک آزمایشگاه متنباز را معرفی کرد که با استفاده از معماری ماشین حالت، اثر مداخلات کوچک تاریخی را در طول قرنها شبیهسازی میکند. این ابزار برخلاف…

یک چارچوب جدید با معرفی «نقشههای منبع» و «گزارشهای کاری»، مرز میان پیشنویسهای هوش مصنوعی و منابع تأییدشده را تفکیک میکند. این متد مانع از جایگزینی پژوهش واقعی با توهمات…

یک نسخه پژوهشی از مدل Claude موفق شد یکی از قدیمیترین مسائل نظری عدد را با افزایش کران پایین تابع زتای ریمان از ۴۱.۶٪ به ۶۷.۲٪ به پیش ببرد. این مدل هرچند فرضیه ریمان را بهطور…