
چرا مقیاس پارامترها برای استدلال کافی نیست: راهکار SEF-CLGC
پژوهشی جدید با معرفی چارچوب SEF-CLGC نشان میدهد که ادغام منطق نمادین در مدلهای زبانی کوچک میتواند سوگیری محتوایی را کاهش دهد. این رویکرد در آزمونهای SemEval-2026 به دقت ۲۷.۸۰…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۷۵ مقاله منتشر شده

پژوهشی جدید با معرفی چارچوب SEF-CLGC نشان میدهد که ادغام منطق نمادین در مدلهای زبانی کوچک میتواند سوگیری محتوایی را کاهش دهد. این رویکرد در آزمونهای SemEval-2026 به دقت ۲۷.۸۰…

پژوهشگران با تنظیم دقیق مدل Qwen3-VL-2B و ادغام دادههای مربوط به نگاه چشم و حرکت خودرو، رکورد جدیدی در پیشبینی قصد عابر پیاده ثبت کردند. این روش بر معماریهای تخصصی ترنسفورمری…

مدلهای زبانی بزرگ اکنون میتوانند بدون هیچ آموزشی، اشیاء محیطهای سهبعدی را با دقت ۹۶ درصد به کلاسهای هستیشناسی متصل کنند. این روش با بهرهگیری از نشانههای معنایی در گراف…

معماری جدید FlashMemory-DeepSeek-V4 با معرفی سازوکار «توجه پراکنده پیشرو»، گلوگاه حافظه GPU را در پردازش متون طولانی برطرف کرده است. این متد بدون کاهش دقت، ردپای حافظه KV را به…

چارچوب جدیدی به نام INFUSER با تغییر رویکرد از دادههای «سخت» به دادههای «مؤثر»، مدلهای هوش مصنوعی را قادر میسازد تا برنامه آموزشی خود را بهطور پویا تکامل دهند. این متد باعث…

یک مطالعه فنی روی مدلهای بینایی-زبانی نشان میدهد که انتخاب بین SFT و OPD در مرحله گرمبندی، تنها بر رژیم آنتروپی اولیه اثر میگذارد و تأثیری بر عملکرد نهایی یادگیری تقویتشده…

چارچوب SafeRun با جداسازی تفسیر زبان طبیعی از اجرای محدودیتهای سخت، ایمنی کامل در برنامهریزیهای ورزشی را تضمین میکند. این متد در بنچمارکهای جدید، عملکرد مهندسی پرامپت و…

چارچوب TRIAGE با جایگزینی پیشبینیهای باینری و بیشازحد مطمئن با امتیازات ریسک پیوسته، خطای کالیبراسیون در مدلهای زبانی بزرگ پزشکی را ۸۱٪ کاهش داده است. این رویکرد از طریق…

پژوهشگران ابزاری به نام ATM را معرفی کردهاند که ارزیابی مدلهای جهانی نهفته را به جای اجرای کند شبیهسازها، با پروبهای سبک انجام میدهد. این متد با شناسایی سریع شکستهای…

پژوهشگران با ابداع یک چرخهٔ چندعاملی شامل «هکر» و «اصلاحگر»، نرخ موفقیت حملات پاداشجویانه در بنچمارکهای هوش مصنوعی را به صفر رساندند. این روش با خودکارسازی شناسایی و وصله کردن…

چارچوب آموزشی جدیدی به نام PACT با تفکیک پارادایمهای استدلالی به شاخههای مجزای LoRA، دقت مدلهای زبانی در تشخیص پزشکی را بهبود بخشیده است. این سیستم از طریق تجمیع شاخهها بر…

کارگاه CHIIR ۲۰۲۶ گذار از بازیابی سنتی اسناد به «سنتز زاینده» در پژوهشهای دانشگاهی را ترسیم میکند. این چارچوب بر طراحی انسانمحور با تمرکز بر شفافیت و یکپارچگی پژوهشی تأکید دارد.