پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۹ مقاله منتشر شده

Reasoning Arena: غلبه بر مشکل پاداش‌های تخت در آموزش مدل‌های استدلالی

Reasoning Arena: غلبه بر مشکل پاداش‌های تخت در آموزش مدل‌های استدلالی

چارچوب Reasoning Arena با جایگزینی سیگنال‌های باینری با تورنمنتهای مقایسه‌ای، دقت مدل‌ها در ریاضی و کدنویسی را ۷.۶٪ افزایش داد. این متد ضمن ارتقای عملکرد، هزینه محاسبات تولید را…

۲ دقیقه خواندن
PhysScene: گذار از بازشناسی بصری به استدلال رابطه‌ای در آزمایشگاه‌های فیزیک

PhysScene: گذار از بازشناسی بصری به استدلال رابطه‌ای در آزمایشگاه‌های فیزیک

پژوهشگران مجموعه داده PhysScene را معرفی کردند؛ نخستین گراف صحنه تخصصی برای محیط‌های آزمایشگاهی فیزیک. هدف این پروژه تغییر تمرکز مدل‌ها از روابط مکانی ساده به وابستگی‌های عملکردی…

۱ دقیقه خواندن
چرا دقت دکودر برای توقف تزریق‌های پرامپت مغزی کافی نیست؟

چرا دقت دکودر برای توقف تزریق‌های پرامپت مغزی کافی نیست؟

پژوهشگران نوع جدیدی از حملات به نام «تزریق پرامپت مغزی» را شناسایی کرده‌اند که از طریق اختلال در سیگنال‌های عصبی، عامل‌های BCI-LLM را به کنترل درمی‌آورد. این مطالعه ثابت می‌کند که…

۲ دقیقه خواندن۱
PyGeoX: افزایش ۲.۳ برابری دقت حل مسائل هندسی با سیستم پاداش SAR

PyGeoX: افزایش ۲.۳ برابری دقت حل مسائل هندسی با سیستم پاداش SAR

پژوهشگران با معرفی PyGeoX و مکانیزم پاداش SAR، نرخ موفقیت مدل‌های زبانی در حل مسائل پیچیده هندسی را ۲.۳ برابر کردند. این روش با جلوگیری از «پوشش گرادیان‌های پرت»، مانع از توهم مدل…

۱ دقیقه خواندن۱
چگونه MetaSeq با تبدیل هندسه به زبان، خطای طراحی متامتریال را ۴۵٪ کاهش داد؟

چگونه MetaSeq با تبدیل هندسه به زبان، خطای طراحی متامتریال را ۴۵٪ کاهش داد؟

پژوهشگران با توسعه MetaSeq، طراحی متامتریال‌های آکوستیک را به یک مسئله توالی-به-توالی تبدیل کرده‌اند. این سیستم با جایگزینی نمایش‌های پیکسلی با یک زبان توالی‌محورِ مبتنی بر فیزیک،…

۱ دقیقه خواندن۱
BSTabDiff: راهکاری برای غلبه بر «نفرین ابعاد» در تولید داده‌های مصنوعی جدولی

BSTabDiff: راهکاری برای غلبه بر «نفرین ابعاد» در تولید داده‌های مصنوعی جدولی

پژوهشگران چارچوبی به نام BSTabDiff را برای تولید داده‌های جدولی مصنوعی در حوزه‌هایی که تعداد ویژگی‌ها بسیار بیشتر از نمونه‌هاست، توسعه داده‌اند. این سیستم با استفاده از…

۱ دقیقه خواندن۳
ArXiv: کاهش ۲۵.۵ درصدی زمان آموزش مدل‌های چند-GPU با روش Shaping حافظه مشترک

ArXiv: کاهش ۲۵.۵ درصدی زمان آموزش مدل‌های چند-GPU با روش Shaping حافظه مشترک

پژوهشگران روشی برای هم‌پوشانی (Overlap) محاسبات و ارتباطات در محیط‌های چند-GPU ابداع کرده‌اند که زمان اجرای کل را تا ۲۵.۵٪ کاهش می‌دهد. این دستاورد بدون تغییر در کتابخانه‌های…

۱ دقیقه خواندن۱
بهبود ۶ درصدی تشخیص کم‌نمونه با رفع عدم‌توازن در پیشنهادهای ناحیه‌ای

بهبود ۶ درصدی تشخیص کم‌نمونه با رفع عدم‌توازن در پیشنهادهای ناحیه‌ای

یک رویکرد جدید در تشخیص اشیاء کم‌نمونه (FSOD) با اصلاح عدم‌توازن بین پیشنهادهای کلاس‌های پایه و جدید، دقت مدل‌ها را ۱ تا ۶ درصد افزایش داده است. این روش بدون ایجاد تأخیر در زمان…

۱ دقیقه خواندن۲
چرا مدل‌های بنیادی EEG حتی در حالت منجمد، ویژگی‌های طیفی را لو می‌دهند؟

چرا مدل‌های بنیادی EEG حتی در حالت منجمد، ویژگی‌های طیفی را لو می‌دهند؟

پژوهشگران دریافتند که مدل‌های بنیادی EEG حتی پس از عبور از بازرسی‌های امنیتی، همچنان ویژگی‌های طیفی حساس را فاش می‌کنند. این مطالعه با معرفی یک چارچوب بازرسی مشترک، ناکارآمدی…

۲ دقیقه خواندن
حذف حسگرهای لمسی با EgoTactile؛ تخمین فشار دست از روی ویدیو

حذف حسگرهای لمسی با EgoTactile؛ تخمین فشار دست از روی ویدیو

پژوهشگران چارچوب EgoTactile را معرفی کردند که می‌تواند فشار گیرش دست را تنها از طریق ویدیوهای اول‌شخص تخمین بزند. این سیستم با استفاده از مدل‌های انتشار، نیاز به سخت‌افزارهای لمسی…

۱ دقیقه خواندن
چگونه «بومی‌سازی فرهنگی» نرخ موفقیت حملات به مدل‌های زبانی را ۹.۳٪ افزایش داد؟

چگونه «بومی‌سازی فرهنگی» نرخ موفقیت حملات به مدل‌های زبانی را ۹.۳٪ افزایش داد؟

ترجمهٔ مستقیم بنچمارک‌های ایمنی انگلیسی برای شناسایی آسیب‌پذیری‌های مدل‌های زبانی در محیط‌های آسیایی ناکارآمد است. مطالعه‌ای جدید ثابت می‌کند که رِد-تیمینگ متناسب با فرهنگ‌های…

۱ دقیقه خواندن
ترکیب SPDL و SAC: حذف طراحی دستی برنامه‌ی آموزشی در موتورسیکلت‌های خودران

ترکیب SPDL و SAC: حذف طراحی دستی برنامه‌ی آموزشی در موتورسیکلت‌های خودران

پژوهشگران با ترکیب یادگیری تقویت‌شده‌ی SAC و یک برنامه آموزشی خودگردان (SPDL)، سیستمی برای آموزش موتورسیکلت‌های مسابقه‌ای خودران توسعه داده‌اند. این رویکرد نیاز به طراحی دستی…

۱ دقیقه خواندن