
دقت ۹۶ درصدی مدلهای زبانی در مبنیسازی اشیاء سهبعدی بدون نیاز به آموزش
مدلهای زبانی بزرگ اکنون میتوانند بدون هیچ آموزشی، اشیاء محیطهای سهبعدی را با دقت ۹۶ درصد به کلاسهای هستیشناسی متصل کنند. این روش با بهرهگیری از نشانههای معنایی در گراف…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۷۷ مقاله منتشر شده

مدلهای زبانی بزرگ اکنون میتوانند بدون هیچ آموزشی، اشیاء محیطهای سهبعدی را با دقت ۹۶ درصد به کلاسهای هستیشناسی متصل کنند. این روش با بهرهگیری از نشانههای معنایی در گراف…

معماری جدید FlashMemory-DeepSeek-V4 با معرفی سازوکار «توجه پراکنده پیشرو»، گلوگاه حافظه GPU را در پردازش متون طولانی برطرف کرده است. این متد بدون کاهش دقت، ردپای حافظه KV را به…

چارچوب جدیدی به نام INFUSER با تغییر رویکرد از دادههای «سخت» به دادههای «مؤثر»، مدلهای هوش مصنوعی را قادر میسازد تا برنامه آموزشی خود را بهطور پویا تکامل دهند. این متد باعث…

یک مطالعه فنی روی مدلهای بینایی-زبانی نشان میدهد که انتخاب بین SFT و OPD در مرحله گرمبندی، تنها بر رژیم آنتروپی اولیه اثر میگذارد و تأثیری بر عملکرد نهایی یادگیری تقویتشده…

چارچوب SafeRun با جداسازی تفسیر زبان طبیعی از اجرای محدودیتهای سخت، ایمنی کامل در برنامهریزیهای ورزشی را تضمین میکند. این متد در بنچمارکهای جدید، عملکرد مهندسی پرامپت و…

چارچوب TRIAGE با جایگزینی پیشبینیهای باینری و بیشازحد مطمئن با امتیازات ریسک پیوسته، خطای کالیبراسیون در مدلهای زبانی بزرگ پزشکی را ۸۱٪ کاهش داده است. این رویکرد از طریق…

پژوهشگران ابزاری به نام ATM را معرفی کردهاند که ارزیابی مدلهای جهانی نهفته را به جای اجرای کند شبیهسازها، با پروبهای سبک انجام میدهد. این متد با شناسایی سریع شکستهای…

پژوهشگران با ابداع یک چرخهٔ چندعاملی شامل «هکر» و «اصلاحگر»، نرخ موفقیت حملات پاداشجویانه در بنچمارکهای هوش مصنوعی را به صفر رساندند. این روش با خودکارسازی شناسایی و وصله کردن…

چارچوب آموزشی جدیدی به نام PACT با تفکیک پارادایمهای استدلالی به شاخههای مجزای LoRA، دقت مدلهای زبانی در تشخیص پزشکی را بهبود بخشیده است. این سیستم از طریق تجمیع شاخهها بر…

کارگاه CHIIR ۲۰۲۶ گذار از بازیابی سنتی اسناد به «سنتز زاینده» در پژوهشهای دانشگاهی را ترسیم میکند. این چارچوب بر طراحی انسانمحور با تمرکز بر شفافیت و یکپارچگی پژوهشی تأکید دارد.

پژوهشگران پدیده «حذف خاموش دامنه» (SSO) را شناسایی کردهاند؛ اختلالی که در آن مدلهای زبانی قوانین کلی را میپذیرند اما استثنائات تودرتو را نادیده میگیرند. راهکار پیشنهادی،…

پژوهشگران یک چارچوب بینایی-زبانی دو-مرحلهای طراحی کردهاند که قادر است خطاهای خود را در تشخیص نقصهای لیتوگرافی شناسایی و اصلاح کند. این سیستم با آموزش یک ماژول پالایش روی…