پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۰ مقاله منتشر شده

ارزیابی جدید: مدل‌های هوش مصنوعی در درک جداول اسناد اندونزیایی

ارزیابی جدید: مدل‌های هوش مصنوعی در درک جداول اسناد اندونزیایی

محققان مجموعه داده INDOTABVQA را با ۱٬۵۹۳ تصویر سند به زبان باهاسا اندونزی و پرسش‌وپاسخ‌های چندزبانه منتشر کردند. این معیار برای آزمون مدل‌های بینایی-زبانی در درک متقابل جداول…

۱ دقیقه خواندن
چارچوب جدید POMDP برای کنترل دقیق تقاضای حافظه در یادگیری تقویتی

چارچوب جدید POMDP برای کنترل دقیق تقاضای حافظه در یادگیری تقویتی

پژوهشگران چارچوبی نظری معرفی کرده‌اند که امکان طراحی دقیق محیط‌های POMDP با ساختارهای تقاضای حافظه از پیش تعیین‌شده را فراهم می‌کند. این رویکرد به محققان اجازه می‌دهد تا به‌صورت…

۱ دقیقه خواندن
روشی تازه برای مقابله با حملات جیل‌بریک از درون مدل‌های زبانی بزرگ

روشی تازه برای مقابله با حملات جیل‌بریک از درون مدل‌های زبانی بزرگ

پژوهشگران چارچوبی به نام ASGuard طراحی کرده‌اند که با تحلیل مسیرهای عصبی داخلی مدل‌های زبانی بزرگ، حملات جیل‌بریک مبتنی بر تغییر زمان فعل را شناسایی و خنثی می‌کند. این روش توانسته…

۲ دقیقه خواندن
محققان روش «کاپو» را برای رفع اعتماد بیش از حد مدل‌های زبانی ارائه دادند

محققان روش «کاپو» را برای رفع اعتماد بیش از حد مدل‌های زبانی ارائه دادند

تیمی از محققان روش آموزشی جدیدی به نام «بهینه‌سازی خط‌مشی آگاه از کالیبراسیون» (CAPO) معرفی کرده‌اند که مشکل اعتماد بیش از حد مدل‌های زبانی بزرگ را حل می‌کند. این روش بدون کاهش…

۱ دقیقه خواندن۱
ظهور سرهای توجه تخصصی در مدل‌های استدلالی از طریق پس‌آموزش

ظهور سرهای توجه تخصصی در مدل‌های استدلالی از طریق پس‌آموزش

پژوهشی جدید نشان می‌دهد که تکنیک‌های پس‌آموزش، سرهای توجه تخصصی را در مدل‌های هوش مصنوعی پدید می‌آورند که استدلال پیچیده را ممکن می‌سازند، اما در عوض دقت محاسبات ساده را کاهش…

۲ دقیقه خواندن
دوک‌سیکر: روشی نوین برای تحلیل هوشمند اسناد بلند با استدلال بصری

دوک‌سیکر: روشی نوین برای تحلیل هوشمند اسناد بلند با استدلال بصری

دوک‌سیکر یک چارچوب آموزشی دو مرحله‌ای برای مدل‌های زبانی چندوجهی ارائه می‌دهد که اسناد طولانی را از طریق سه مرحله تحلیل، محلی‌سازی و استدلال پردازش می‌کند. این روش با مشکلات نسبت…

۱ دقیقه خواندن
تحقیق جدید: عملکرد مدل‌های زبانی با تغییرات ظریف در پرامپت تا ۶۱.۸٪ کاهش می‌یابد

تحقیق جدید: عملکرد مدل‌های زبانی با تغییرات ظریف در پرامپت تا ۶۱.۸٪ کاهش می‌یابد

پژوهشی تازه منتشر شده در arxiv.org از چارچوب ارزیابی جدیدی به نام IFEval++ رونمایی کرده که «اعتمادپذیری ظریف‌محور» در مدل‌های زبانی را می‌سنجد. بررسی ۴۶ مدل نشان داده که عملکرد…

۱ دقیقه خواندن۱
تست نفوذ مدل‌های استدلالی بزرگ: معیاری تازه برای سنجش اعتمادپذیری

تست نفوذ مدل‌های استدلالی بزرگ: معیاری تازه برای سنجش اعتمادپذیری

پژوهشگران معیار RT-LRM را برای ارزیابی صداقت، امنیت و کارایی مدل‌های استدلالی بزرگ پیشنهاد کرده‌اند. یافته‌ها نشان می‌دهد این مدل‌ها در مقایسه با مدل‌های زبانی معمولی، با چالش‌های…

۲ دقیقه خواندن۱
روشی بدون آموزش مجدد برای کاهش توهم در مدل‌های زبانی چندوجهی

روشی بدون آموزش مجدد برای کاهش توهم در مدل‌های زبانی چندوجهی

پژوهشگران روش «رمزگشایی از طریق اختلال» (DeP) را معرفی کرده‌اند که بدون نیاز به آموزش مجدد، توهمات مدل‌های زبانی چندوجهی را کاهش می‌دهد. این روش با اعمال مداخلات متنی کنترل‌شده در…

۱ دقیقه خواندن۱
اسپک‌باند: حدس‌زنی کران‌دار تطبیقی برای استنتاج سریع‌تر مدل‌های زبانی بزرگ

اسپک‌باند: حدس‌زنی کران‌دار تطبیقی برای استنتاج سریع‌تر مدل‌های زبانی بزرگ

پژوهشگران چارچوبی به نام اسپک‌باند معرفی کرده‌اند که با استفاده از تابکاری دمایی لایه‌به‌لایه و کران‌گذاری تطبیقی بر طول حدس، سرعت استنتاج مدل‌های زبانی را تا ۲.۳۳ برابر افزایش…

۱ دقیقه خواندن