
پژوهش تازه: مدلهای زبانی بزرگ در درک مفاهیم انتزاعی ناتواناند
پژوهشی تازه نشان میدهد مدلهای زبانی بزرگ، از جمله **جیپیتی-۴او**، در درک مفاهیم انتزاعی حتی در سادهترین سناریوها ضعیف عمل میکنند. مدلهای آموزشدیده مانند **برت** و…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۶۵۱ مقاله منتشر شده

پژوهشی تازه نشان میدهد مدلهای زبانی بزرگ، از جمله **جیپیتی-۴او**، در درک مفاهیم انتزاعی حتی در سادهترین سناریوها ضعیف عمل میکنند. مدلهای آموزشدیده مانند **برت** و…

چارچوبی نوین برای پردازش تدریجی ادبیات علمی معرفی شد. این سیستم با کاهش ۹۲ درصدی هزینه محاسباتی، بازدهی تولید فرضیه را بهطور چشمگیری افزایش میدهد. کلید اصلی: بهروزرسانی پایگاه…

پژوهشگران چارچوب **PR-MaGIC** را معرفی کردند که بدون نیاز به آموزش، پرامپتها را از طریق جریان گرادیان دیکودر ماسک **سام** (SAM) اصلاح میکند. این روش بدون تغییر معماری یا داده…

پژوهشگران چارچوب دفاعی Safe-FedLLM را معرفی کردند که با تحلیل بهروزرسانیهای LoRA بهعنوان نشانگرهای رفتاری، کلاینتهای مخرب را شناسایی و سرکوب میکند. این روش بدون کاهش محسوس…

پژوهشگران دریافتند بنچمارکهای فعلی به جای تسلط واقعی بر زبان، توانایی ریاضی و یادآوری اطلاعات را میسنجند. روش ترجمه رفتوبرگشتی با رتبهبندی کاربران همبستگی ۰.۹۴ نشان داده است.…

پژوهشگران روشی مبتنی بر یادگیری تقویتی ارائه کردهاند که به مدلهای زبانی کمک میکند با درخواستهای مبهم کاربران بهتر کنار بیایند. این رویکرد به جای تکیه بر یک تفسیر واحد، طیفی از…

پژوهشگران «لتنتریفیوژال» را معرفی کردند؛ روشی که با تحلیل فعالسازیهای لایه پنهان مدلهای زبانی بزرگ، پرسشهای مبهم یا بیپاسخ را شناسایی میکند. این رویکرد امتیاز افوان ۸۸.۵…

پژوهشی تازه نشان داده که کدهای تولیدشده توسط مدلهای زبانی بزرگ در کاربردهای ایمنی ساختمان، اغلب از نظر دستوری درست به نظر میرسند اما درک عمیقی از خطرات محیط ساختوساز ندارند.…

متا از Muse Spark رونمایی کرد — اولین مدل جدید این شرکت پس از یک سال و اولین محصول آزمایشگاه ابرصنعتی متا. این مدل کاملاً اختصاصی است و برخلاف مدلهای قبلی، دسترسی آزاد به وزنها…

پژوهشگران روشی تازه برای هماهنگی مدلهای زبانی بزرگ معرفی کردهاند. این سامانه با فعالسازی هوش مصنوعی زاینده (Generative AI) در مرزهای تصمیمگیری، دقت را تا ۲۶.۷۵ درصد افزایش…

تیمی از پژوهشگران مدل **مانتس** (Mantis) را توسعه دادهاند که صرفاً از شبیهسازیهای مکانیکی آموزش دیده و با وجود عدم مواجهه با دادههای واقعی، از تمام مدلهای مرکز کنترل بیماری…

پژوهشگران چارچوب موبی را معرفی کردند که اولین راهکار دودوییسازی مخصوص مدلهای زبانی بزرگ مبتنی بر مخلوط کارشناسان است. این چارچوب سه چالش کلیدی را حل میکند و سرعت استنتاج را بیش…