پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۹ مقاله منتشر شده

چرا برای ساخت مدل‌های دقیق‌تر، باید کمتر کد بنویسیم؟

چرا برای ساخت مدل‌های دقیق‌تر، باید کمتر کد بنویسیم؟

پژوهشگران روشی را ابداع کرده‌اند که در آن مدل‌های زبانی به‌جای بازنویسی کامل معماری‌های عصبی، تنها تغییرات ضروری (Diffs) را اعمال می‌کنند. این رویکرد طول خروجی را تا ۸۵٪ کاهش داده…

۲ دقیقه خواندن۲
چگونه True Memory بدون GPU و دیتابیس برداری، حافظه‌ی AI را متحول کرد؟

چگونه True Memory بدون GPU و دیتابیس برداری، حافظه‌ی AI را متحول کرد؟

معماری True Memory با جایگزینی خلاصه‌سازی‌های زودهنگام با بازیابی دقیق (Verbatim)، استانداردهای حافظه‌ی عامل‌های هوش مصنوعی را جابه‌جا کرده است. این سیستم که تنها بر بستر SQLite…

۲ دقیقه خواندن۲
پایان تبعیض نژادی در تشخیص گلوکوم؛ رمزگشایی از مدل FairEnc

پایان تبعیض نژادی در تشخیص گلوکوم؛ رمزگشایی از مدل FairEnc

پژوهشگران با معرفی مدل FairEnc توانستند سوگیری‌های نژادی و جنسیتی را از سیستم‌های تشخیص بیماری گلوکوم حذف کنند. این مدل چندوجهی با استفاده از داده‌های مصنوعی و یادگیری تقابلی، دقت…

۲ دقیقه خواندن۲
پایان خطای تخمین پاداش؛ تحولی در یادگیری تقویت‌شده برای محیط‌های متغیر

پایان خطای تخمین پاداش؛ تحولی در یادگیری تقویت‌شده برای محیط‌های متغیر

یک مقاله پژوهشی جدید با معرفی اپراتور میانگین هارمونیک اصلاح‌شده، مشکل عدم دقت نرخ پاداش در SMDPها را حل کرده است. این رویکرد باعث می‌شود الگوریتم‌های RL حتی در محیط‌های غیرایستا…

۲ دقیقه خواندن۲
آیا می‌توان انقلاب صنعتی بعدی را پیش از ساخت اولین نمونه پیش‌بینی کرد؟

آیا می‌توان انقلاب صنعتی بعدی را پیش از ساخت اولین نمونه پیش‌بینی کرد؟

پژوهشگران با معرفی مدل TechToken، سیگنال‌های نوآوری را در زبان پتنت‌ها کشف کرده‌اند. این مدل ترنسفورمر-محور می‌تواند ترکیب‌های تکنولوژیک جدید را دهه‌ها پیش از ظهور واقعی‌شان…

۲ دقیقه خواندن۱
پروژه MIA: نقشه‌ی راه شناختی برای درک استعاره‌ها در هوش مصنوعی

پروژه MIA: نقشه‌ی راه شناختی برای درک استعاره‌ها در هوش مصنوعی

یک مجموعه داده جدید از ردیابی چشم نشان می‌دهد که یادگیرندگان زبان دوم ابتدا اصطلاحات را به‌صورت تحت‌اللفظی پردازش می‌کنند. این منبع، معیاری حیاتی برای سنجش میزان شباهت درک مدل‌های…

۲ دقیقه خواندن۱
رمزگشایی از هنر روایت؛ پایان عصر داستان‌های خسته‌کننده در AI

رمزگشایی از هنر روایت؛ پایان عصر داستان‌های خسته‌کننده در AI

پژوهشگران با معرفی StoryAlign، شکاف میان منطق ماشین و جذابیت روایت‌های انسانی را هدف قرار داده‌اند. این مدل با آموزش روی ۱۰۰ هزار جفت ترجیح، استانداردهای جدیدی را برای تولید…

۲ دقیقه خواندن۱
پایان عصر بازنمونه‌برداری گران‌قیمت برای تخمین عدم قطعیت در گراف‌ها

پایان عصر بازنمونه‌برداری گران‌قیمت برای تخمین عدم قطعیت در گراف‌ها

محققان چارچوب QpiGNN را معرفی کردند که تخمین عدم قطعیت در شبکه‌های عصبی گراف را بدون نیاز به محاسبات سنگین ممکن می‌کند. این مدل در ۱۹ بنچ‌مارک مختلف، پوشش بسیار دقیق‌تر و بازه‌های…

۲ دقیقه خواندن۴
درون معماری FLO-EMD: پایان توهمات بصری در سیستم‌های مدیریت شهری

درون معماری FLO-EMD: پایان توهمات بصری در سیستم‌های مدیریت شهری

پژوهشگران با معرفی چارچوب FLO-EMD، دقت تشخیص ترافیک شهری را به ۹۷.۵ درصد رساندند. این سیستم با ترکیب تحلیل‌های مکانی و دینامیک‌های زمانی، مشکل خطاهای بصری در مدل‌های سنتی را حل…

۲ دقیقه خواندن۱
فریب خوردن انسان‌ها؛ حقیقت تکان‌دهنده درباره‌ی تشخیص جعل عمیق

فریب خوردن انسان‌ها؛ حقیقت تکان‌دهنده درباره‌ی تشخیص جعل عمیق

انسان‌ها در شناسایی جعل‌های عمیق پیشرفته، به‌ویژه مدل‌های ترکیبی صوتی-تصویری، به‌شدت ناتوان هستند. این مطالعه نشان می‌دهد که تکیه بر شهود انسانی برای تشخیص محتوای دست‌کاری‌شده…

۲ دقیقه خواندن۱
مطالعه Arxiv: دقت ۷۵ درصدی Gemini 2.5 Pro در شبیه‌سازی الگوهای شناختی

مطالعه Arxiv: دقت ۷۵ درصدی Gemini 2.5 Pro در شبیه‌سازی الگوهای شناختی

محققان با استفاده از Gemini 2.5 Pro سیستمی برای خلق «همزادهای شناختی» ساخته‌اند که می‌تواند الگوهای تفکر انسان را با دقت ۷۵ درصد بازسازی کند. این دستاورد، مسیر آموزش شخصی‌سازی‌شده…

۲ دقیقه خواندن۱
چرا برای رسیدن به هوش واقعی باید ترنسفورمرها را دور ریخت؟

چرا برای رسیدن به هوش واقعی باید ترنسفورمرها را دور ریخت؟

مدل جدیدی به نام Gyan با جایگزینی معماری ترنسفورمر، توهمات را حذف و هزینه‌های محاسباتی را به شدت کاهش داده است. این مدل با جداسازی نمایش دانش از پردازش زبان، استانداردهای جدیدی در…

۲ دقیقه خواندن۱