
چرا برای ساخت مدلهای دقیقتر، باید کمتر کد بنویسیم؟
پژوهشگران روشی را ابداع کردهاند که در آن مدلهای زبانی بهجای بازنویسی کامل معماریهای عصبی، تنها تغییرات ضروری (Diffs) را اعمال میکنند. این رویکرد طول خروجی را تا ۸۵٪ کاهش داده…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۶۹ مقاله منتشر شده

پژوهشگران روشی را ابداع کردهاند که در آن مدلهای زبانی بهجای بازنویسی کامل معماریهای عصبی، تنها تغییرات ضروری (Diffs) را اعمال میکنند. این رویکرد طول خروجی را تا ۸۵٪ کاهش داده…

معماری True Memory با جایگزینی خلاصهسازیهای زودهنگام با بازیابی دقیق (Verbatim)، استانداردهای حافظهی عاملهای هوش مصنوعی را جابهجا کرده است. این سیستم که تنها بر بستر SQLite…

پژوهشگران با معرفی مدل FairEnc توانستند سوگیریهای نژادی و جنسیتی را از سیستمهای تشخیص بیماری گلوکوم حذف کنند. این مدل چندوجهی با استفاده از دادههای مصنوعی و یادگیری تقابلی، دقت…

یک مقاله پژوهشی جدید با معرفی اپراتور میانگین هارمونیک اصلاحشده، مشکل عدم دقت نرخ پاداش در SMDPها را حل کرده است. این رویکرد باعث میشود الگوریتمهای RL حتی در محیطهای غیرایستا…

پژوهشگران با معرفی مدل TechToken، سیگنالهای نوآوری را در زبان پتنتها کشف کردهاند. این مدل ترنسفورمر-محور میتواند ترکیبهای تکنولوژیک جدید را دههها پیش از ظهور واقعیشان…

یک مجموعه داده جدید از ردیابی چشم نشان میدهد که یادگیرندگان زبان دوم ابتدا اصطلاحات را بهصورت تحتاللفظی پردازش میکنند. این منبع، معیاری حیاتی برای سنجش میزان شباهت درک مدلهای…

پژوهشگران با معرفی StoryAlign، شکاف میان منطق ماشین و جذابیت روایتهای انسانی را هدف قرار دادهاند. این مدل با آموزش روی ۱۰۰ هزار جفت ترجیح، استانداردهای جدیدی را برای تولید…

محققان چارچوب QpiGNN را معرفی کردند که تخمین عدم قطعیت در شبکههای عصبی گراف را بدون نیاز به محاسبات سنگین ممکن میکند. این مدل در ۱۹ بنچمارک مختلف، پوشش بسیار دقیقتر و بازههای…

پژوهشگران با معرفی چارچوب FLO-EMD، دقت تشخیص ترافیک شهری را به ۹۷.۵ درصد رساندند. این سیستم با ترکیب تحلیلهای مکانی و دینامیکهای زمانی، مشکل خطاهای بصری در مدلهای سنتی را حل…

انسانها در شناسایی جعلهای عمیق پیشرفته، بهویژه مدلهای ترکیبی صوتی-تصویری، بهشدت ناتوان هستند. این مطالعه نشان میدهد که تکیه بر شهود انسانی برای تشخیص محتوای دستکاریشده…

محققان با استفاده از Gemini 2.5 Pro سیستمی برای خلق «همزادهای شناختی» ساختهاند که میتواند الگوهای تفکر انسان را با دقت ۷۵ درصد بازسازی کند. این دستاورد، مسیر آموزش شخصیسازیشده…

مدل جدیدی به نام Gyan با جایگزینی معماری ترنسفورمر، توهمات را حذف و هزینههای محاسباتی را به شدت کاهش داده است. این مدل با جداسازی نمایش دانش از پردازش زبان، استانداردهای جدیدی در…