
Uni-E: راهکاری برای حذف خطای توزیع در مدلهای انتشار زبانی
پژوهشگران با معرفی چارچوب Uni-E توانستند شکاف عملکرد میان مدلهای انتشار زبانی و مدلهای خودرگرسیونی را کاهش دهند. این روش با جایگزینی تخمینهای احتمالی با محاسبات دقیق انرژی،…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۶۹ مقاله منتشر شده

پژوهشگران با معرفی چارچوب Uni-E توانستند شکاف عملکرد میان مدلهای انتشار زبانی و مدلهای خودرگرسیونی را کاهش دهند. این روش با جایگزینی تخمینهای احتمالی با محاسبات دقیق انرژی،…

چارچوب CANS با استفاده از یادگیری مشارکتی، تأخیر در استنتاج مدلهای هوش مصنوعی در شبکههای لبهای را تا ۵۰ درصد کاهش میدهد. این راهکار با بهینهسازی پویا در تقسیمبندی مدلها،…

پژوهشی جدید با معرفی چارچوب SEF-CLGC نشان میدهد که ادغام منطق نمادین در مدلهای زبانی کوچک میتواند سوگیری محتوایی را کاهش دهد. این رویکرد در آزمونهای SemEval-2026 به دقت ۲۷.۸۰…

پژوهشگران با تنظیم دقیق مدل Qwen3-VL-2B و ادغام دادههای مربوط به نگاه چشم و حرکت خودرو، رکورد جدیدی در پیشبینی قصد عابر پیاده ثبت کردند. این روش بر معماریهای تخصصی ترنسفورمری…

پژوهشگران روشی را کشف کردهاند که اجازه میدهد پیامهای مخفی ۳۲ بیتی را بدون تغییر در وزنهای مدل، تنها با دستکاری بذرهای تصادفی در خروجیهای LLM جایگذاری کنند. این متد حتی بدون…

مدلهای زبانی بزرگ اکنون میتوانند بدون هیچ آموزشی، اشیاء محیطهای سهبعدی را با دقت ۹۶ درصد به کلاسهای هستیشناسی متصل کنند. این روش با بهرهگیری از نشانههای معنایی در گراف…

شکستهای زیرساختی ابر اکنون سریعتر از واکنش انسانها رخ میدهند. یک معماری جدید هوش مصنوعی عاملمحور در یکی از ارائهدهندگان بزرگ ابر، اکنون بیش از ۹۰ درصد از حوادث رایج شبکه را…

پژوهشگران با ترکیب «انتشار تعادلی» و دینامیک ایسینگ، راهکاری برای رفع خطاهای همگرایی در مدلهای انرژیمحور ابداع کردند. این رویکرد نوآورانه اجازه میدهد دقت این مدلها در…

پژوهشگران یک «شکاف منشأ» در عاملهای هوش مصنوعی شناسایی کردهاند که اجازه میدهد درخواستهای مضر در قالب فایلهای بهظاهر بیخطر پنهان شوند. متد جدید CFD با دور زدن فیلترهای متنی،…

الگوریتم جدید BAVAR-BLED با ترکیب مدلهای بیزی و توزیعهای بیضوی در یک معماری یادگیری تقویتشده، توانسته است بازدهی ۵۷.۲۶ درصدی را در سهام داوجونز ثبت کند. این سیستم با هدف…

پژوهشی جدید نشان میدهد Nearly یکچهارم از مخازن کد که از تنظیمات متنی برای هدایت هوش مصنوعی استفاده میکنند، با دادههای منسوخ روبهرو هستند. این پدیده که «پوسیدگی متنی» نامیده…

معماری جدید FlashMemory-DeepSeek-V4 با معرفی سازوکار «توجه پراکنده پیشرو»، گلوگاه حافظه GPU را در پردازش متون طولانی برطرف کرده است. این متد بدون کاهش دقت، ردپای حافظه KV را به…