
کمیته مدلهای بازمتن در برابر مدلهای تکسازه غولپیکر در مهندسی
چارچوب جدید Fusion-MOA با ایجاد یک «کمیته فنی» از مدلهای کوچک و بازمتن، در وظایف مهندسی پیچیده از مدلهای غولپیکر ابری پیشی گرفت. این رویکرد ثابت میکند سازماندهی هوشمند مدلها…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۰۹۶ مقاله منتشر شده

چارچوب جدید Fusion-MOA با ایجاد یک «کمیته فنی» از مدلهای کوچک و بازمتن، در وظایف مهندسی پیچیده از مدلهای غولپیکر ابری پیشی گرفت. این رویکرد ثابت میکند سازماندهی هوشمند مدلها…

پلتفرم Paradigm شبیهسازی جدیدی را برای تحلیل اقتصاد «خودبهسازی بازگشتی» مدلهای هوش مصنوعی عرضه کرد. این ابزار نشان میدهد حتی با دسترسی به هوش نامحدود، کمبود داده و توان…

یک عامل امنیتی جدید با استفاده از ساختار دو مرحلهای «پوسته-عمق»، کدهای پایتون را بازرسی میکند. این سیستم با اجبار مدل دوم به نقد یافتههای مدل اول، آسیبپذیریهای پیچیده را…

یک مدل آزمایشی از شرکت آنتروپیک با استفاده از یک سامانه چندعاملی، موفق شد کران پایین راهکارهای فرضیه ریمان را افزایش دهد. این دستاورد حاصل بررسی ۶۵۰ ایده مختلف طی ۳۶ ساعت محاسبات…

استقرار مدلهای استدلالی عمیق بهدلیل گسترش توکنها در زنجیره تفکر، هزینههای غیرقابلپیشبینی ایجاد میکند. Oxlo.ai با جایگزینی صورتحساب توکنمحور با هزینه ثابت بهازای هر…

پیادهسازی جدید Oxlo.ai نشان میدهد چگونه میتوان از طبقهبندی سادهی تیکتها به سمت عاملهای استدلالی حرکت کرد. این سامانه با اجبار مدل به طی کردن زنجیرهی تفکر در قالب JSON، علت…

پژوهشگران امنیتی روشی برای استخراج متون رمزنگاریشدهی «زنجیره تفکر» از مدلهای تجاری یافتند. این آسیبپذیری منجر به افشای صدها راز خصوصی، از جمله کلیدهای API و رمزهای عبور شده…

موش سامبول از Lightrun استدلال میکند که مهندسی پرامپت برای ساخت عاملهای آمادهی تولید کافی نیست. او معماری «هدایت قطعی» را پیشنهاد میدهد که در آن اقدامات مدل توسط مشاهدهپذیری…

سیستم حافظه جدید ALTK-Evolve با جایگزینی «دفترچه راهنمای کامل» با «درسهای منتخب»، مصرف توکن را بهشدت کاهش میدهد. این رویکرد بدون افت دقت، هزینههای عملیاتی مدلهای قوی و ضعیف…

انویدیا مدل Nemotron-3.5-Lightning-30B را برای بهینهسازی عاملهای خودکار و استنتاج محلی عرضه کرد. این مدل با ترکیب معماری MoE و Mamba، پنجره متنی عظیم یک میلیون توکنی را روی…

مدل منتشرنشدهٔ Astra توانسته است ۱۰ مسئلهٔ پیچیده ریاضی را که دههها ریاضیدانان را به چالش کشیده بود، حل کند. این دستاورد در حالی رخ داده که بحثهای شدیدی دربارهٔ سرقت اعتبار علمی…

پژوهشگران آسیبپذیری جدیدی را کشف کردند که اجازه میدهد با استفاده از نسخههای کوچکتر مدلها، «افکار درونی» و زنجیره تفکر مدلهای قدرتمند رمزگشایی شود. این نقص امنیتی ریسک نشت…