
بهینهسازی ترجیح بصری مبتنی بر معیار برای استدلال چندوجهی
پژوهشگران rDPO را معرفی کردند؛ چارچوبی نوآورانه که از چکلیستهای معیارمحور خاص هر نمونه برای بهبود استدلال بصری در سیستمهای هوش مصنوعی چندوجهی بهره میبرد. این روش با ارائه…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۵۴ مقاله منتشر شده

پژوهشگران rDPO را معرفی کردند؛ چارچوبی نوآورانه که از چکلیستهای معیارمحور خاص هر نمونه برای بهبود استدلال بصری در سیستمهای هوش مصنوعی چندوجهی بهره میبرد. این روش با ارائه…

پژوهشگران رویکرد «استدلال مبتنی بر محاسبه» (CGR) را معرفی کردهاند که در آن، محاسبات قطعی پیش از تولید پاسخ توسط مدلهای زبانی، اطلاعات فضایی را تأیید میکند. این روش خطاهای…

گوگل در سال ۲۰۲۵ رکورد ۸.۳ میلیارد آگهی را مسدود کرد — ۶۳ درصد بیشتر از سال قبل. این شرکت با بهرهگیری از مدلهای **جمینای** (Gemini)، بیش از ۹۹ درصد آگهیهای نقضکننده را پیش از…

پژوهشی تازه نشان میدهد مدلهای زبانی بزرگ، از جمله **جیپیتی-۴او**، در درک مفاهیم انتزاعی حتی در سادهترین سناریوها ضعیف عمل میکنند. مدلهای آموزشدیده مانند **برت** و…

چارچوبی نوین برای پردازش تدریجی ادبیات علمی معرفی شد. این سیستم با کاهش ۹۲ درصدی هزینه محاسباتی، بازدهی تولید فرضیه را بهطور چشمگیری افزایش میدهد. کلید اصلی: بهروزرسانی پایگاه…

پژوهشگران چارچوب **PR-MaGIC** را معرفی کردند که بدون نیاز به آموزش، پرامپتها را از طریق جریان گرادیان دیکودر ماسک **سام** (SAM) اصلاح میکند. این روش بدون تغییر معماری یا داده…

پژوهشگران چارچوب دفاعی Safe-FedLLM را معرفی کردند که با تحلیل بهروزرسانیهای LoRA بهعنوان نشانگرهای رفتاری، کلاینتهای مخرب را شناسایی و سرکوب میکند. این روش بدون کاهش محسوس…

پژوهشگران دریافتند بنچمارکهای فعلی به جای تسلط واقعی بر زبان، توانایی ریاضی و یادآوری اطلاعات را میسنجند. روش ترجمه رفتوبرگشتی با رتبهبندی کاربران همبستگی ۰.۹۴ نشان داده است.…

پژوهشگران روشی مبتنی بر یادگیری تقویتی ارائه کردهاند که به مدلهای زبانی کمک میکند با درخواستهای مبهم کاربران بهتر کنار بیایند. این رویکرد به جای تکیه بر یک تفسیر واحد، طیفی از…

پژوهشگران «لتنتریفیوژال» را معرفی کردند؛ روشی که با تحلیل فعالسازیهای لایه پنهان مدلهای زبانی بزرگ، پرسشهای مبهم یا بیپاسخ را شناسایی میکند. این رویکرد امتیاز افوان ۸۸.۵…

پژوهشی تازه نشان داده که کدهای تولیدشده توسط مدلهای زبانی بزرگ در کاربردهای ایمنی ساختمان، اغلب از نظر دستوری درست به نظر میرسند اما درک عمیقی از خطرات محیط ساختوساز ندارند.…

متا از Muse Spark رونمایی کرد — اولین مدل جدید این شرکت پس از یک سال و اولین محصول آزمایشگاه ابرصنعتی متا. این مدل کاملاً اختصاصی است و برخلاف مدلهای قبلی، دسترسی آزاد به وزنها…