پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۷۶ مقاله منتشر شده

چرا مدل‌های کوچک در یادگیری آنلاین بر Qwen-3-14B و DeepSeek-V3 پیروز می‌شوند؟

چرا مدل‌های کوچک در یادگیری آنلاین بر Qwen-3-14B و DeepSeek-V3 پیروز می‌شوند؟

پژوهشی جدید نشان می‌دهد توکن‌های بافت نهفته پیوسته به مدل‌های کوچک اجازه می‌دهند الگوریتم‌های یادگیری آنلاین را بهینه‌تر از مدل‌های زبانی بزرگ اجرا کنند. یک مدل با معماری GPT-2 با…

۲ دقیقه خواندن۱
گزارش PrimeKG-CL: اثر ۶۰ درصدی ویژگی‌های چندوجهی بر دقت مدل‌های زیست‌پزشکی

گزارش PrimeKG-CL: اثر ۶۰ درصدی ویژگی‌های چندوجهی بر دقت مدل‌های زیست‌پزشکی

بنچمارک جدید PrimeKG-CL نشان می‌دهد که استفاده از ویژگی‌های چندوجهی می‌تواند دقت وظایف هوش مصنوعی در حوزه زیست‌پزشکی را تا ۶۰٪ افزایش دهد. این مطالعه همچنین شکست‌های جدی در…

۲ دقیقه خواندن۱
رمزگشایی از MoPO: حذف لرزش در مدل‌های سه بعدی با الگوهای حرکتی

رمزگشایی از MoPO: حذف لرزش در مدل‌های سه بعدی با الگوهای حرکتی

چارچوب MoPO با معرفی مکانیسم پیش‌فرض‌های حرکتی، مشکل لرزش و عدم دقت در بازسازی مش‌های انسانی هنگام انسداد (Occlusion) را حل می‌کند. این مدل با استفاده از داده‌های تاریخی ژست‌ها،…

۲ دقیقه خواندن
سازوکار تنوع پرچم‌ها: چرا همراستاسازی وزن‌ها در شبکه‌های عمیق اجتناب‌ناپذیر است؟

سازوکار تنوع پرچم‌ها: چرا همراستاسازی وزن‌ها در شبکه‌های عمیق اجتناب‌ناپذیر است؟

یک چارچوب نظری جدید ثابت می‌کند که همراستاسازی ماتریس‌های وزن در شبکه‌های عمیق، یک ضرورت ریاضی است و نه یک اتفاق تجربی. این پژوهش با استفاده از تنوع پرچم‌ها، تبیینی بنیادین برای…

۲ دقیقه خواندن۲
چرا کالیبراسیون مبتنی بر مسیریابی در ترنسفورمرها یک توهم ظرفیتی است؟

چرا کالیبراسیون مبتنی بر مسیریابی در ترنسفورمرها یک توهم ظرفیتی است؟

تحلیل فنی ترنسفورمرهای Attention-Residual نشان می‌دهد که ردپاهای مسیریابی داخلی، شواهد پایداری برای کالیبراسیون پس‌ینی فراهم نمی‌کنند. این مطالعه هشدار می‌دهد که بهبودهای ظاهری در…

۲ دقیقه خواندن۱
سازوکار FEM: رفع خطای Mode-Bridge در شبکه‌های بیزی ترکیبی با تنظیم دره‌های داده

سازوکار FEM: رفع خطای Mode-Bridge در شبکه‌های بیزی ترکیبی با تنظیم دره‌های داده

پژوهشگران مدل FEM را برای حذف «مصنوعات پل-مود» در شبکه‌های بیزی ترکیبی معرفی کردند. این مدل با استفاده از تکنیک تنظیم دره، توهمات احتمالی در نقاط خالی بین خوشه‌های داده را از بین…

۲ دقیقه خواندن۱
رمزگشایی از علت واگرایی آموزش FP4 و نقش چرخش‌های قطعی هادامار

رمزگشایی از علت واگرایی آموزش FP4 و نقش چرخش‌های قطعی هادامار

پژوهشگران دریافتند که کوانتیزاسیون گرادینت‌های وزن (Wgrad) عامل اصلی ناپایداری در آموزش مدل‌های زبانی با دقت FP4 است. استفاده از چرخش‌های قطعی هادامار، برخلاف روش‌های تصادفی،…

۲ دقیقه خواندن
گزارش arXiv: نرخ موفقیت عامل‌های کدنویس با متد Shepherd به ۵۴.۷٪ رسید

گزارش arXiv: نرخ موفقیت عامل‌های کدنویس با متد Shepherd به ۵۴.۷٪ رسید

پلتفرم Shepherd با معرفی زیرساختی مبتنی بر برنامه‌نویسی تابعی، تعاملات عامل‌ها را به عنوان رویدادهای کنترل‌شده مدیریت می‌کند. این رویکرد سرعت بازتولید وضعیت‌ها را ۵ برابر بیشتر از…

۲ دقیقه خواندن
گزارش BenchCAD: ناتوانی مدل‌های پیشرو در تولید کدهای اجرایی برای طراحی صنعتی

گزارش BenchCAD: ناتوانی مدل‌های پیشرو در تولید کدهای اجرایی برای طراحی صنعتی

بنچمارک جدید BenchCAD نشان می‌دهد مدل‌های پیشرو در عین توانایی در تقلید بصری، در تولید کدهای پارامتریک دقیق برای تولید صنعتی شکست می‌خورند. این مطالعه شکاف عمیق میان استدلال فضایی…

۲ دقیقه خواندن
چرا حذف کامل «سندهای مزاحم» حیاتی‌تر از کاهش حجم پنجره متنی است؟

چرا حذف کامل «سندهای مزاحم» حیاتی‌تر از کاهش حجم پنجره متنی است؟

حضور مقدار اندکی اطلاعات گمراه‌کننده در متون طولانی، باعث سقوط غیرخطی عملکرد مدل‌های زبانی می‌شود. این یافته نشان می‌دهد که دقت در بازیابی داده‌ها بسیار حیاتی‌تر از کاهش کلی حجم…

۲ دقیقه خواندن