
کمریزنر درک حرکت دوربین را با استدلال ساختاریافته بهبود میبخشد
پژوهشگران کمریزنر را معرفی کردند؛ چارچوبی که با استدلال ساختاریافته، درک حرکت دوربین در ویدئو را بهبود میدهد و به دستاوردهای دقت قابلتوجهی در معیارهای ارزیابی دست یافته است.
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۰۳ مقاله منتشر شده

پژوهشگران کمریزنر را معرفی کردند؛ چارچوبی که با استدلال ساختاریافته، درک حرکت دوربین در ویدئو را بهبود میدهد و به دستاوردهای دقت قابلتوجهی در معیارهای ارزیابی دست یافته است.

چارچوب RationalRewards مدلهای پاداش چندبُعدی را معرفی میکند که در زمان آموزش و آزمایش، کیفیت تولیدکنندههای تصویر را بهبود میبخشند. این مدل به دقت بالا در پیشبینی ترجیحات دست…

پژوهشگران چارچوب «MemJack» را معرفی کردهاند؛ یک سیستم حمله چندعامله که با بهرهگیری از ساختارهای معنایی تصاویر، مدلهای بینایی-زبانی را هدف قرار میدهد. این روش در آزمایشها علیه…

پژوهشگران چارچوب مُدیکس را توسعه دادهاند که بدون نیاز به آموزش، نحوه تخصیص موقعیت در مدلهای بینایی-زبان را بر اساس چگالی اطلاعات در هر بخش تنظیم میکند. این روش با اختصاص دقت…

IDEA با تبدیل فرایند تصمیمگیری مدلهای زبانی بزرگ به یک مدل پارامتری قابل تفسیر، مشکل احتمالهای نادقیق، توضیحات غیرواقعی و ناتوانی در ادغام دقیق دانش تخصصی را حل میکند. این…

پژوهشگران rDPO را معرفی کردند؛ چارچوبی نوآورانه که از چکلیستهای معیارمحور خاص هر نمونه برای بهبود استدلال بصری در سیستمهای هوش مصنوعی چندوجهی بهره میبرد. این روش با ارائه…

پژوهشگران رویکرد «استدلال مبتنی بر محاسبه» (CGR) را معرفی کردهاند که در آن، محاسبات قطعی پیش از تولید پاسخ توسط مدلهای زبانی، اطلاعات فضایی را تأیید میکند. این روش خطاهای…

گوگل در سال ۲۰۲۵ رکورد ۸.۳ میلیارد آگهی را مسدود کرد — ۶۳ درصد بیشتر از سال قبل. این شرکت با بهرهگیری از مدلهای **جمینای** (Gemini)، بیش از ۹۹ درصد آگهیهای نقضکننده را پیش از…

پژوهشی تازه نشان میدهد مدلهای زبانی بزرگ، از جمله **جیپیتی-۴او**، در درک مفاهیم انتزاعی حتی در سادهترین سناریوها ضعیف عمل میکنند. مدلهای آموزشدیده مانند **برت** و…

چارچوبی نوین برای پردازش تدریجی ادبیات علمی معرفی شد. این سیستم با کاهش ۹۲ درصدی هزینه محاسباتی، بازدهی تولید فرضیه را بهطور چشمگیری افزایش میدهد. کلید اصلی: بهروزرسانی پایگاه…

پژوهشگران چارچوب **PR-MaGIC** را معرفی کردند که بدون نیاز به آموزش، پرامپتها را از طریق جریان گرادیان دیکودر ماسک **سام** (SAM) اصلاح میکند. این روش بدون تغییر معماری یا داده…

پژوهشگران چارچوب دفاعی Safe-FedLLM را معرفی کردند که با تحلیل بهروزرسانیهای LoRA بهعنوان نشانگرهای رفتاری، کلاینتهای مخرب را شناسایی و سرکوب میکند. این روش بدون کاهش محسوس…