پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۷ مقاله منتشر شده

افشای شکاف استدلالی؛ مدل‌های متن‌باز در برابر آزمون DiffCap-Bench شکست خوردند

افشای شکاف استدلالی؛ مدل‌های متن‌باز در برابر آزمون DiffCap-Bench شکست خوردند

معرفی بنچ‌مارک DiffCap-Bench نشان داد که مدل‌های تجاری در درک تفاوت‌های بصری، فرسنگ‌ها از مدل‌های متن‌باز جلوترند. این یافته ثابت می‌کند که صرفاً بزرگ‌تر کردن مدل‌ها، مشکل استدلال…

۲ دقیقه خواندن۱
روشی که خطاهای تکراری مدل‌های تشخیص اشیاء را برای همیشه پاک می‌کند

روشی که خطاهای تکراری مدل‌های تشخیص اشیاء را برای همیشه پاک می‌کند

چارچوب EBOD با ادغام SAM3 و DINOv3، خطاهای تکراری در تشخیص اشیاء را بدون نیاز به آموزش مجدد مدل حذف می‌کند. این رویکرد هزینه‌های محاسباتی سنگین را کنار گذاشته و یادگیری از…

۲ دقیقه خواندن۳
پایان عصر شباهت‌سنجی؛ چگونه VACAI-Bowl درک زبان‌های نادر را متحول کرد؟

پایان عصر شباهت‌سنجی؛ چگونه VACAI-Bowl درک زبان‌های نادر را متحول کرد؟

پژوهشگران با معرفی چارچوب VACAI-Bowl، دقت تجزیه وابستگی در زبان‌های کم‌منبع را بیش از ۵۴ درصد افزایش دادند. این سیستم به جای جستجوی شباهت‌ها، از تفاوت‌های زبانی برای بهبود یادگیری…

۲ دقیقه خواندن۳
توقف بهینه‌سازی برای مرتبط بودن؛ وقتی «مفید بودن» بازی RAG را عوض می‌کند

توقف بهینه‌سازی برای مرتبط بودن؛ وقتی «مفید بودن» بازی RAG را عوض می‌کند

پژوهشگران چارچوب CAR را معرفی کردند؛ سیستمی که به جای شباهت معنایی، بر اساس توانایی سند در افزایش «اطمینان» مدل، رتبه‌بندی را تغییر می‌دهد. این رویکرد نویز را در خط لوله‌های تولید…

۳ دقیقه خواندن
جهش خیره‌کننده در دقت شناسایی گونه‌های نادر؛ راهکاری برای غلبه بر کمبود داده

جهش خیره‌کننده در دقت شناسایی گونه‌های نادر؛ راهکاری برای غلبه بر کمبود داده

یک رویکرد جدید عصبی-نمادین با ترکیب قوانین منطقی و یادگیری عمیق، مشکل کمبود داده در شناسایی موجودات نام‌دار (NER) را حل کرده است. این سیستم در حوزه‌های تخصصی، به‌ویژه شناسایی…

۲ دقیقه خواندن۲
رمزگشایی از معماری پنهانی که مدل‌های بینایی را در برابر حملات مصون می‌کند

رمزگشایی از معماری پنهانی که مدل‌های بینایی را در برابر حملات مصون می‌کند

یک مطالعه جدید نشان می‌دهد مقاومت مدل‌های بینایی در برابر حملات خصمانه ناشی از فیلترهای فرکانسی نیست، بلکه ریشه در هندسه‌ی بازنمایی شبیه به انسان دارد. این کشف، مسیر مقابله با…

۲ دقیقه خواندن۱
درون معماری جدید: وقتی LLM فرمانده پهپادهای شهری می‌شود

درون معماری جدید: وقتی LLM فرمانده پهپادهای شهری می‌شود

پژوهشگران با ترکیب یادگیری تقویت‌شده عمیق و مدل‌های زبانی بزرگ، سیستمی برای مدیریت بهینه پهپادها در شهرهای متراکم طراحی کرده‌اند. این معماری با رفع ناهماهنگی‌های منابع، نرخ موفقیت…

۲ دقیقه خواندن
چرا نظارت انسانی بر آموزش مدل‌های زبانی دیگر لازم نیست

چرا نظارت انسانی بر آموزش مدل‌های زبانی دیگر لازم نیست

پژوهشگران چارچوب RFT-FM را معرفی کردند که شناسایی و رفع خطاهای تنظیم دقیق مدل‌های زبانی را به‌طور خودکار مدیریت می‌کند. این سیستم با استفاده از اولین بنچ‌مارک جامع در این حوزه،…

۲ دقیقه خواندن۱
چرا لایه‌های نرمال‌سازی تنها یک راهکار موقت برای خطاهای ریاضی بودند؟

چرا لایه‌های نرمال‌سازی تنها یک راهکار موقت برای خطاهای ریاضی بودند؟

معرفی بهینه‌ساز MACRO که با استفاده از محدودیت‌های منیفولد، نیاز به Weight Decay و نرمال‌سازی RMS را از بین می‌برد. این چارچوب پایداری آموزش مدل‌های زبانی بزرگ را از طریق هندسه‌ی…

۲ دقیقه خواندن۱