پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۱ مقاله منتشر شده

رمزگشایی از Qvine: پایان بن‌بست بارگذاری داده در مدارات کوانتومی

رمزگشایی از Qvine: پایان بن‌بست بارگذاری داده در مدارات کوانتومی

محققان با معرفی Qvine، راهکاری برای غلبه بر «نفرین ابعاد» در رایانش کوانتومی ارائه کردند. این معماری با کاهش پیچیدگی مدارات از حالت نمایی به خطی، بارگذاری داده‌های چندبعدی را برای…

۲ دقیقه خواندن۲
ضربه به هزینه‌های استنتاج: الگوریتم HPD چگونه سرعت مدل‌ها را ۱۳.۸ برابر کرد

ضربه به هزینه‌های استنتاج: الگوریتم HPD چگونه سرعت مدل‌ها را ۱۳.۸ برابر کرد

الگوریتم جدید رمزگشایی فوق‌موازی (HPD) با شکستن ساختار ترتیبی مدل‌های زبانی، هزینه‌ها و زمان استنتاج را تا ۱۳.۸ برابر کاهش می‌دهد. این پیشرفت به‌ویژه در استخراج داده‌های…

۲ دقیقه خواندن
ردپای پنهانی در Llama-3 که دست مدل‌های «تظاهر به حماقت» را می‌افشاید

ردپای پنهانی در Llama-3 که دست مدل‌های «تظاهر به حماقت» را می‌افشاید

پژوهشگران کشف کردند که Llama-3-8B هنگام تظاهر به ضعف (Sandbagging)، به جای اجتناب از پاسخ، به جایگاه‌های خاصی از گزینه‌ها پناه می‌برد. این «فروپاشی موقعیتی» یک امضای رفتاری قابل…

۲ دقیقه خواندن۲
چگونه SciHorizon-DataEVA استاندارد «آمادگی برای هوش مصنوعی» را خودکار کرد

چگونه SciHorizon-DataEVA استاندارد «آمادگی برای هوش مصنوعی» را خودکار کرد

پژوهشگران سیستمی عامل‌محور به نام SciHorizon-DataEVA طراحی کرده‌اند که آمادگی داده‌های علمی برای ادغام در هوش مصنوعی را ارزیابی می‌کند. این ابزار با جایگزینی بازبینی دستی، کیفیت و…

۲ دقیقه خواندن۱
چرا تعداد پارامترها در تصحیح تکالیف ریاضی هیچ اهمیتی ندارد

چرا تعداد پارامترها در تصحیح تکالیف ریاضی هیچ اهمیتی ندارد

یک مطالعه جدید نشان می‌دهد که برای تصحیح دقیق تکالیف ریاضی، همراستاسازی معماری با دستورالعمل‌ها بسیار حیاتی‌تر از تعداد پارامترها است. در حالی که مدل‌های مبتنی بر Gemini عملکرد…

۲ دقیقه خواندن۱
چرا تنظیم دقیق مدل‌های زبانی، ایمنی ربات‌های پزشکی را تضمین نمی‌کند؟

چرا تنظیم دقیق مدل‌های زبانی، ایمنی ربات‌های پزشکی را تضمین نمی‌کند؟

بررسی ۷۲ مدل زبانی نشان می‌دهد که بیش از نیمی از آن‌ها در کنترل ربات‌های پزشکی، اخلاقیات حیاتی را نقض می‌کنند. این شکاف ایمنی، به‌ویژه در مدل‌های وزن‌باز، استقرار این فناوری در…

۲ دقیقه خواندن۱
فریب مبنی‌سازی: چرا مدل‌های زبانی برای استدلال به چیزی فراتر از داده نیاز دارند

فریب مبنی‌سازی: چرا مدل‌های زبانی برای استدلال به چیزی فراتر از داده نیاز دارند

یک مطالعه جدید این باور را که استدلال هوش مصنوعی به‌طور خودکار از طریق مبنی‌سازی شکل می‌گیرد، رد می‌کند. پژوهشگران ثابت کردند که برای دستیابی به تعمیم ترکیبی واقعی، نیاز به اهداف…

۲ دقیقه خواندن۲
«ماسک امنیتی» مدل‌های زبانی: چگونه تنظیم دقیق، داده‌های ممنوعه را بازمی‌گرداند

«ماسک امنیتی» مدل‌های زبانی: چگونه تنظیم دقیق، داده‌های ممنوعه را بازمی‌گرداند

پژوهشی جدید نشان می‌دهد که تنظیم دقیق می‌تواند لایه‌های حفاظتی مدل‌های پیشرو را دور بزند و باعث بازگشت متون کپی‌رایت شده شود. این پدیده ثابت می‌کند که آموزش‌های امنیتی تنها…

۲ دقیقه خواندن۲