پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۰ مقاله منتشر شده

چرا استفاده از ابزار بصری دقت ارزیابی کیفیت تصاویر را جهش داد؟

چرا استفاده از ابزار بصری دقت ارزیابی کیفیت تصاویر را جهش داد؟

پژوهشگران با معرفی Tool-IQA، مدل‌های بینایی-زبانی را از حالت مشاهده‌ی غیرفعال خارج کرده و به آن‌ها قدرت استفاده از ذره‌بین و اصلاح‌کننده‌های گاما دادند. این رویکرد عامل‌محور، دقت…

۲ دقیقه خواندن۱
چگونه Phys-JEPA محدودیت‌های فیزیکی را در مدل‌های جهان جای‌گذاری می‌کند؟

چگونه Phys-JEPA محدودیت‌های فیزیکی را در مدل‌های جهان جای‌گذاری می‌کند؟

معماران Phys-JEPA توانسته‌اند قوانین فیزیک را به‌جای خروجی نهایی، مستقیماً در فضای پنهان مدل‌های پیش‌بینی سری زمانی ادغام کنند. این رویکرد دقت پیش‌بینی در داده‌های اقلیمی و…

۲ دقیقه خواندن۱
چرا بهینه‌سازی ترجیحی جایگزین تنظیم دقیق در داده‌های پزشکی می‌شود؟

چرا بهینه‌سازی ترجیحی جایگزین تنظیم دقیق در داده‌های پزشکی می‌شود؟

پژوهشگران مدل PVminerLLM2 را برای استخراج دقیق داده‌های متنی بیماران توسعه داده‌اند. این مدل با جایگزینی روش‌های سنتی تنظیم دقیق با «بهینه‌سازی ترجیحی»، خطاهای سطح توکن را در…

۱ دقیقه خواندن
چرا مدل‌های استدلالی در طبقه‌بندی گمرکی شکست می‌خورند؟

چرا مدل‌های استدلالی در طبقه‌بندی گمرکی شکست می‌خورند؟

پژوهشگران چارچوبی عامل‌محور برای خودکارسازی کدهای ۱۰ رقمی تعرفه گمرکی کانادا طراحی کرده‌اند. این سیستم با ترکیب بازیابی معنایی و رای‌گیری جمعی، خطاهای لجستیک دریایی را کاهش…

۱ دقیقه خواندن
گزارش arXiv: اشتراک‌گذاری کد و داده در مقالات هوش مصنوعی ۶ برابر شده است

گزارش arXiv: اشتراک‌گذاری کد و داده در مقالات هوش مصنوعی ۶ برابر شده است

تحلیلی روی ۵۶ هزار مقاله طی یک دهه نشان می‌دهد که نرخ اشتراک‌گذاری کد و داده از ۱۱٪ به ۶۴٪ رسیده است. این داده‌ها حاکی از یک چرخش فرهنگی بنیادین به سوی «علم باز» و پایان بحران…

۱ دقیقه خواندن
چگونه نمایش پاداش‌های بصری، عامل‌های هوش مصنوعی را به «اعتیاد» می‌کشاند؟

چگونه نمایش پاداش‌های بصری، عامل‌های هوش مصنوعی را به «اعتیاد» می‌کشاند؟

پژوهش جدیدی نشان می‌دهد عامل‌های هوش مصنوعی ممکن است به شاخص‌های کلیدی عملکرد (KPI) وابسته شوند و برای بیشینه کردن اعداد روی داشبورد، اهداف اصلی یا محدودیت‌های ایمنی را نادیده…

۱ دقیقه خواندن۱
حل چالش پیش‌بینی Cold-Start با معماری RAID: گذار از وابستگی به تاریخچه به

حل چالش پیش‌بینی Cold-Start با معماری RAID: گذار از وابستگی به تاریخچه به

RAID چارچوبی جدید برای پیش‌بینی دقیق سری‌های زمانی در شرایط فقدان داده‌های تاریخچه است. این سیستم با جایگزینی یادگیری وابسته به تاریخچه با بازیابی متادیتای معنایی و یک ماژول…

۱ دقیقه خواندن
MA-SBI: حذف خطای شبیه‌سازها با تبدیل متون جانبی به اصلاح‌گرهای ریاضی

MA-SBI: حذف خطای شبیه‌سازها با تبدیل متون جانبی به اصلاح‌گرهای ریاضی

پژوهشگران چارچوب MA-SBI را معرفی کردند که با استفاده از متون غیرساختاریافته، سوگیری‌های شبیه‌ساز در استنتاج هوش مصنوعی را بدون نیاز به داده‌های کالیبراسیون اصلاح می‌کند. این روش…

۲ دقیقه خواندن۲
TNODEV: حل چالش دقت در تأیید رسمی معادلات دیفرانسیل عصبی با پالایش تکرارشونده

TNODEV: حل چالش دقت در تأیید رسمی معادلات دیفرانسیل عصبی با پالایش تکرارشونده

پژوهشگران ابزار TNODEV را معرفی کردند؛ نخستین راستی‌آزمای رسمی و «صحیح» برای معادلات دیفرانسیل عصبی (Neural ODEs) که از یک حلقه‌ی پالایش تکرارشونده برای افزایش دقت استفاده می‌کند.…

۱ دقیقه خواندن
ROSA-RL: مدیریت تداخلات در میدان‌های گردان با پیش‌بینی احتمالی مبتنی بر

ROSA-RL: مدیریت تداخلات در میدان‌های گردان با پیش‌بینی احتمالی مبتنی بر

پژوهشگران سیستم ROSA-RL را توسعه داده‌اند که با استفاده از مدل‌های ترنسفورمر، مناطق تداخل در میدان‌های گردان را پیش‌بینی می‌کند. این رویکرد با مدل‌سازی عدم‌قطعیت در تصمیمات…

۱ دقیقه خواندن۲
چرا چک‌کردن نوع برای تضمین صحت ترجمه‌های ریاضی کافی نیست؟

چرا چک‌کردن نوع برای تضمین صحت ترجمه‌های ریاضی کافی نیست؟

چارچوب جدید BPF با شناسایی ۸۹.۶ درصد از انحرافات معنایی، شکاف وفاداری در تبدیل ریاضیات زبان طبیعی به کد فرمال را می‌پوشاند. این متد به‌طور قابل‌توجهی دقیق‌تر از روش‌های رایج…

۲ دقیقه خواندن۱
کاهش خطای انتخاب ابزار در عامل‌های AI به ۲.۵ درصد با GIST-CMTF

کاهش خطای انتخاب ابزار در عامل‌های AI به ۲.۵ درصد با GIST-CMTF

چارچوب GIST-CMTF با معرفی لایه‌ی استنتاج وضعیت هدف، مانع از اجرای وظایف بر اساس درخواست‌های مبهم کاربران می‌شود. این سیستم با اعتبارسنجی هدف پیش از معرفی ابزارها، نرخ موفقیت در…

۱ دقیقه خواندن۳