پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۴ مقاله منتشر شده

PhantomBench: نرخ توهم ۸۶.۷ درصدی مدل‌های زبانی در مواجهه با مفاهیم ناموجود

PhantomBench: نرخ توهم ۸۶.۷ درصدی مدل‌های زبانی در مواجهه با مفاهیم ناموجود

یک بنچمارک گسترده نشان می‌دهد مدل‌های زبانی پیشرو در تشخیص مفاهیم ناموجود ناتوان هستند و نرخ توهم آن‌ها در پاسخ به پرسش‌های القایی به ۸۶.۷٪ می‌رسد. این یافته لزوم تغییر تمرکز از…

۱ دقیقه خواندن
استراتژی آموزش سه‌مرحله‌ای RoboNaldo برای حل مشکل تعادل در ضربات انفجاری ربات‌ها

استراتژی آموزش سه‌مرحله‌ای RoboNaldo برای حل مشکل تعادل در ضربات انفجاری ربات‌ها

پژوهشگران با معرفی چارچوب RoboNaldo، ربات‌های انسان‌نما را قادر ساختند تا ضربات فوتبال را با سرعت ۱۳.۱ متر بر ثانیه و پایداری بالا اجرا کنند. این سیستم با استفاده از یادگیری…

۲ دقیقه خواندن۱
چرا GASLoC در آموزش مدل‌های زبانی بر سخت‌افزارهای ناهمگن از DiLoCo پیشی می‌گیرد؟

چرا GASLoC در آموزش مدل‌های زبانی بر سخت‌افزارهای ناهمگن از DiLoCo پیشی می‌گیرد؟

پژوهشگران الگوریتم GASLoC را برای پیش‌آموزش غیرمتمرکز مدل‌های زبانی معرفی کرده‌اند که گلوگاه‌های ارتباطی همگام را حذف می‌کند. این چارچوب به‌ویژه در محیط‌هایی با سخت‌افزارهای متنوع…

۱ دقیقه خواندن
چرا شخصیت‌بخشی در مدل‌های چندوجهی، دقت استدلال بصری را کاهش می‌دهد؟

چرا شخصیت‌بخشی در مدل‌های چندوجهی، دقت استدلال بصری را کاهش می‌دهد؟

پژوهش‌های جدید روی مدل‌های زبانی چندوجهی نشان می‌دهد که القای شخصیت در حالی که کیفیت توصیف تصاویر را بالا می‌برد، باعث افت عملکرد در وظایف استدلالی دقیق می‌شود. این مطالعه همچنین…

۱ دقیقه خواندن
تثبیت مسیرهای رانندگی خودکار با DFP: گذار از کپی‌برداری تاریخچه به کنترل پویا

تثبیت مسیرهای رانندگی خودکار با DFP: گذار از کپی‌برداری تاریخچه به کنترل پویا

چارچوب جدیدی به نام Diffusion Forcing Planner (DFP) با جداسازی نویز تاریخچه و آینده، مشکل لرزش مسیر در خودروهای خودران را حل کرده است. این روش به جای کپی‌برداری ساده از الگوهای…

۱ دقیقه خواندن۱
رانش هندسی در ۱۰۰ گام؛ چرا فرضیه صفحهٔ ثابت در مدل‌های زبانی شکست خورد؟

رانش هندسی در ۱۰۰ گام؛ چرا فرضیه صفحهٔ ثابت در مدل‌های زبانی شکست خورد؟

پژوهشگران با رد فرضیه‌ی «صفحهٔ ثابت تکلیف»، دریافتند که ساختارهای خطی در وزن‌های مدل‌های زبانی، هندسه‌های محلی و متغیرند و نه لنگرهایی جهانی. این یافته نشان می‌دهد که مسیرهای…

۱ دقیقه خواندن۲
چرا دقت یکسان در تشخیص جعل عمیق، حاصل سیگنال‌های متفاوتی است؟

چرا دقت یکسان در تشخیص جعل عمیق، حاصل سیگنال‌های متفاوتی است؟

پژوهشگران یک خط‌لوله تفسیرپذیری ابداع کردند که نشان می‌دهد مدل‌های تشخیص جعل عمیق صوتی، حتی با دقت مشابه، بر اساس معیارهای متفاوتی تصمیم می‌گیرند. این یافته‌ها نشان می‌دهد که…

۱ دقیقه خواندن
تداخل داده‌ای در ۳۹ مجموعه‌داده؛ دلیل متورم شدن دقت تشخیص جعل عمیق صوتی

تداخل داده‌ای در ۳۹ مجموعه‌داده؛ دلیل متورم شدن دقت تشخیص جعل عمیق صوتی

یک بازرسی جامع از ۳۹ مجموعه‌داده‌ی گفتار جعلی، فقدان متادیتای جمعیتی و تداخل شدید منابع را آشکار کرد. این نقص‌ها باعث تورم مصنوعی در معیارهای دقت شده و ارزیابی عدالت‌محور در…

۱ دقیقه خواندن
ASVspoof 5: کاهش نرخ خطای تشخیص جعل عمیق به ۲.۵۷٪ با استراتژی RAT

ASVspoof 5: کاهش نرخ خطای تشخیص جعل عمیق به ۲.۵۷٪ با استراتژی RAT

یک استراتژی آموزشی جدید به نام آموزش ارجاع‌افزا (RAT) دقت تشخیص صدای جعل‌شده را به‌طور قابل‌توجهی افزایش داده است. این روش ثابت می‌کند که استفاده از مراجع گوینده در زمان آموزش،…

۱ دقیقه خواندن۱
چرا میانگین‌گیری از تحلیل‌های انسانی و هوش مصنوعی یک اشتباه ریاضی است؟

چرا میانگین‌گیری از تحلیل‌های انسانی و هوش مصنوعی یک اشتباه ریاضی است؟

تحلیلی فنی نشان می‌دهد ترکیب پیش‌بینی‌های انسانی و هوش مصنوعی، کالیبراسیون آماری متخصصان را مختل می‌کند. در حالی که روش‌های «تفویض» این مشکل را حل می‌کنند، وابستگی شدیدی به…

۱ دقیقه خواندن
مطالعه arXiv: تغییر در رابط کاربری باعث استفاده ۵۵.۸ درصدی از حالت Eco-Mode شد

مطالعه arXiv: تغییر در رابط کاربری باعث استفاده ۵۵.۸ درصدی از حالت Eco-Mode شد

پژوهشگران دریافتند که ادغام ابزارهای آگاهی از انرژی در رابط کاربری چت‌بات‌ها می‌تواند رفتار کاربران را به‌طور معناداری به سمت پایداری سوق دهد. نتایج نشان می‌دهد کاربران در مواردی…

۲ دقیقه خواندن