پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۱ مقاله منتشر شده

چرا «نمی‌دانم» ارزشمندترین پاسخی است که یک VLM می‌تواند بدهد

چرا «نمی‌دانم» ارزشمندترین پاسخی است که یک VLM می‌تواند بدهد

محققان با معرفی چارچوب Visual-Idk، مدل‌های بینایی-زبانی را قادر ساختند تا مرزهای دانش خود را بشناسند و از توهمات پرهیز کنند. این متدولوژی نرخ صداقت مدل‌ها را از ۵۷.۹٪ به ۶۷.۳٪…

۲ دقیقه خواندن۲
تله‌ی LLMها در طراحی گرافیکی: وقتی مدل‌های قدیمی دقیق‌تر عمل می‌کنند

تله‌ی LLMها در طراحی گرافیکی: وقتی مدل‌های قدیمی دقیق‌تر عمل می‌کنند

پژوهشی جدید نشان می‌دهد مدل‌های ترجمه سنتی در حفظ چیدمان بصری متون، از مدل‌های زبانی بزرگ پیشی می‌گیرند. این نتیجه‌ی غیرمنتظره، نیاز صنعت طراحی به معماری‌های ترکیبی را بیش از پیش…

۲ دقیقه خواندن
مطالعه arXiv: کاهش ۹۳.۷ درصدی «تقلب» در مدل‌های یادگیری تقویت‌شده

مطالعه arXiv: کاهش ۹۳.۷ درصدی «تقلب» در مدل‌های یادگیری تقویت‌شده

پژوهشگران چارچوب جدیدی برای یادگیری تقویت‌شده ابداع کرده‌اند که با مدل‌سازی عدم قطعیت، مانع از «تقلب» عامل‌ها برای کسب امتیاز می‌شود. این روش رفتارهای مخرب هک پاداش را تا ۹۳.۷…

۲ دقیقه خواندن
پایان عصر مدل‌های ایستا: TimeMM چگونه سلیقه لحظه‌ای کاربران را پیش‌بینی می‌کند

پایان عصر مدل‌های ایستا: TimeMM چگونه سلیقه لحظه‌ای کاربران را پیش‌بینی می‌کند

پژوهشگران چارچوب TimeMM را معرفی کردند که با استفاده از فیلترینگ طیفی شرطی‌شده با زمان، تغییرات سریع سلیقه کاربران را مدل می‌کند. این سیستم با تعادل پویا میان داده‌های بصری و…

۲ دقیقه خواندن۱
درون سازوکار DSIPA: شکارچی جدید متون تولیدشده توسط ماشین

درون سازوکار DSIPA: شکارچی جدید متون تولیدشده توسط ماشین

پژوهشگران چارچوب جدیدی به نام DSIPA را معرفی کردند که با شناسایی «صلبیت عاطفی» مدل‌های زبانی، متون ماشینی را تشخیص می‌دهد. این سیستم در حوزه‌های خبری و آکادمیک، دقت تشخیص را تا ۵۰…

۲ دقیقه خواندن
پایان عصر توکن‌بندی در پزشکی: چگونه MedSynapse-V شهود بالینی را بازسازی کرد

پایان عصر توکن‌بندی در پزشکی: چگونه MedSynapse-V شهود بالینی را بازسازی کرد

مدل MedSynapse-V با جایگزینی توکن‌بندی گسسته با سیستم حافظه پنهان، توانسته است «شهود بالینی» را در تشخیص‌های پزشکی شبیه‌سازی کند. این چارچوب در دقت تشخیص، عملکردی به‌مراتب برتر از…

۲ دقیقه خواندن
MetaSR: کاهش ۵۰ درصدی پهنای باند در بازسازی تصاویر زاینده

MetaSR: کاهش ۵۰ درصدی پهنای باند در بازسازی تصاویر زاینده

چارچوب MetaSR با استفاده از ترنسفورمرهای انتشار، هزینه انتقال داده‌های تصویری را نصف کرده و همزمان کیفیت را افزایش می‌دهد. این فناوری با جایگزینی متادیتای ثابت با استراتژی‌های…

۲ دقیقه خواندن۲
نقص پنهانی در حافظه‌ی مدل‌های زبانی که آن‌ها را رباتیک نگه می‌دارد

نقص پنهانی در حافظه‌ی مدل‌های زبانی که آن‌ها را رباتیک نگه می‌دارد

پژوهشگران با معرفی StratMem-Bench ثابت کردند که مدل‌های زبانی بزرگ در استفاده استراتژیک از حافظه برای تعاملات اجتماعی شکست می‌خورند. این یافته نشان می‌دهد که مدل‌ها علی‌رغم…

۳ دقیقه خواندن
چرا هیچ «بهترین» دستیار هوش مصنوعی برای مدیریت کریپتو وجود ندارد

چرا هیچ «بهترین» دستیار هوش مصنوعی برای مدیریت کریپتو وجود ندارد

پژوهشگران با معرفی بنچمارک LATTICE ثابت کردند که عامل‌های کریپتو در کیفیت پشتیبانی از تصمیمات کاربر تفاوت‌های شدیدی دارند. این نتایج نشان می‌دهد که هیچ ابزار واحدی برای تمام…

۲ دقیقه خواندن۱
رمزگشایی از SeeCo: چگونه بدون آموزش مجدد، دقت سنجش از دور را بالا ببریم

رمزگشایی از SeeCo: چگونه بدون آموزش مجدد، دقت سنجش از دور را بالا ببریم

پژوهشگران چارچوب SeeCo را معرفی کردند؛ سیستمی که بدون نیاز به آموزش مجدد و هزینه‌بر، خطاهای معنایی مدل‌های سنجش از دور را در لحظه استنتاج اصلاح می‌کند. این ابزار با استفاده از…

۲ دقیقه خواندن