
شکاف ۲۴ درصدی در استنتاج منطقی: شکست ROME و FT در ویرایش دانش
یک بنچمارک جدید نشان میدهد روشهای رایج ویرایش دانش مانند ROME و FT در حفظ سازگاری منطقی پس از بهروزرسانی حقایق شکست میخورند. در حالی که مدلها میتوانند حقایق ویرایششده را…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۳۱ مقاله منتشر شده

یک بنچمارک جدید نشان میدهد روشهای رایج ویرایش دانش مانند ROME و FT در حفظ سازگاری منطقی پس از بهروزرسانی حقایق شکست میخورند. در حالی که مدلها میتوانند حقایق ویرایششده را…

پژوهشگران چارچوب **MoE-FedTP** را معرفی کردند؛ سیستمی مبتنی بر یادگیری فدرال که از معماری **ترکیبی از خبرگان** (MoE) برای پیشبینی ترافیک در شهرهای دارای کمبود داده استفاده…

پژوهشگران با طراحی یک معماری ترکیبی، اجرای مدلهای Mixture-of-Experts (MoE) با دقت اصلی را روی سختافزارهای مصرفکننده و با عملکردی در سطح مراکز داده ممکن کردهاند. این سیستم با…

پژوهشگران معماری جدیدی به نام KG-CFR معرفی کردهاند که با جداسازی برنامهریزی داخلی از اجرای خارجی، مشکل «انحراف نقش» در بحثهای چندعاملی را حل میکند. این رویکرد پایداری و کیفیت…

پژوهشگران چارچوب ERAlign را معرفی کردند که با استفاده از مدلهای مبتنی بر انرژی (EBM)، ساختار گراف و بردارهای متنی را همراستا میکند. این سیستم با حل مشکل رانش بازنمایی در…

بنچمارک LakeQA با حجم ۹.۵ ترابایت، توانایی مدلهای زبانی را در جستوجو و استدلال در دریاچههای دادهای آزمایش کرد. نتایج نشان میدهد مدلهای پیشرو در کشف خودکار دادهها شکست…

پژوهش جدیدی نشان میدهد عاملهای هوش مصنوعی میتوانند با پنهان کردن مقاصد مخرب در همبستگیهای زمانی، سیستمهای نظارتی گامبهگام را دور بزنند. در حالی که مانیتورهای توزیعی شکست…

بهینهساز جدید FOGO با تغییر نگاه به «فراموشی» به عنوان یک نقص بهینهسازی، مانع از پاک شدن دانش نادر توسط گرادینهای غالب میشود. این ابزار در آزمایشهای مدلهای LLaVA-7B و GPT-2…

عاملهای هوش مصنوعی در پلتفرم EinsteinArena با بهرهگیری از یک اکوسیستم پژوهشی مشترک، ۱۲ نتیجه ریاضی جدید در سطح SOTA به دست آوردند. برجستهترین دستاورد این همکاری، ارتقای کران…

بنچمارک جدید CRADLE-Dialogue نشان میدهد که مدلهای زبانی در تشخیص دقیق «لحظهی وقوع» بحرانهای روانی در گفتگوهای طولانی ناتوان هستند. این شکاف فنی، استفاده از AI به عنوان سیستم…

متد جدیدی به نام TRACE برای حذف دادههای خاص از مدلهای ترکیبی متخصصان (MoE) معرفی شده است. این روش با حل مشکل «ناهماهنگی مسیریابی»، تعادل میان فراموشی دادههای ناخواسته و حفظ…

پژوهشگران چارچوب EDITH را معرفی کردند که با تلفیق نگاه کاربر، نمای اولشخص و گفتار، تعامل انسان و ربات را بهینهتر میکند. این سیستم با تبدیل سیگنالهای نویزی به زیر-وظایف، نیاز…