
یادگیری پرامپت رکورد جدیدی در بازنمایی گراف دانش ثبت کرد
روش جدید **RALP** نشان داده است که یادگیری پرامپت میتواند روشهای سنتی بازنمایی گراف دانش را با اختلاف بیش از ۵ درصد شکست دهد. این رویکرد با تبدیل عناصر گراف به سازههای زبانی…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۰۲ مقاله منتشر شده

روش جدید **RALP** نشان داده است که یادگیری پرامپت میتواند روشهای سنتی بازنمایی گراف دانش را با اختلاف بیش از ۵ درصد شکست دهد. این رویکرد با تبدیل عناصر گراف به سازههای زبانی…

گوگل مدل جدید **Veo 3.1 Lite** را به خانواده محصولات ویدیویی خود اضافه کرد. این مدل با قیمتی کمتر از نیمی از Veo 3.1 Fast عرضه میشود اما سرعت پردازش یکسانی ارائه میدهد.…

گوگل جدیدترین مدل صوتی خود، **جمینای ۳.۱ فلش لایو** (Gemini 3.1 Flash Live) را عرضه کرد. این مدل در معیار ComplexFuncBench به امتیاز ۹۰.۸٪ دست یافته و گفتگوی بلادرنگ را در بیش از…

پژوهشگران KG-Reasoner را معرفی کردند؛ چارچوبی که با یادگیری تقویتی، مدلهای زبانی را برای استدلال چندمرحلهای روی گرافهای دانش آموزش میدهد. این رویکرد در هشت معیار سنجش به…

اوپنایآی نسخه بهروزشده جعبهابزار توسعه agents خود را منتشر کرد. قابلیت محیط ایزوله (sandboxing) و مجموعه ابزار تازهای برای ساخت agents ایمنتر در اختیار توسعهدهندگان سازمانی…

الگوریتم BayMOTH بهطور هوشمند بین استفاده از اطلاعات وظایف مرتبط و جستجوی مستقل سوئیچ میکند. این روش مشکل پرسوجوهای غیربهینه را در شرایط عدم تطابق وظایف حل میکند.

محققان چارچوب SCPT را معرفی کردهاند که با استفاده از فیلترهای شیمیایی و آموزش مبتنی بر شباهت، مدلهای زبانی بزرگ را برای بهینهسازی خواص مولکولی بدون از دست دادن ساختار اصلی…

پژوهشگران روشی نوین برای بازسازی تصاویر با وضوح بالا ارائه دادهاند که با استفاده از یک چارچوب نظری مبتنی بر تخمین درستنمایی بیشینه، نویز بهینه میانی را برای فرآیند انتشار معکوس…

پژوهشگران روشی به نام BA-Logic ارائه کردهاند که با آلودهسازی مکانیسم پیشبینی داخلی شبکههای عصبی گرافی، حملات بکدور را بدون نیاز به تغییر برچسبهای آموزشی ممکن میسازد. این…

پژوهشگران SpecBranch را معرفی کردهاند؛ چارچوبی نوآورانه که با ایجاد شاخههای موازی در رمزگشایی حدسی، زمان انتظار میان مدل پیشنویس و مدل هدف را کاهش میدهد. این روش سرعت استنتاج…

پژوهشگران با بررسی ۱۲ معیار سنجش، عملکرد مدلهای زبانی بزرگ در وظایف تأیید صحت را تحلیل کردند. این مطالعه نشان داد که سختی مسئله، توانمندی تولیدکننده و قابلیت تأییدکننده بهصورت…

محققان فریمورک AdaMCoT (زنجیره فکری تطبیقی چندزبانه) را معرفی کردهاند که با هدایت پویای فرآیندهای تفکر از طریق «زبانهای میانی» و سپس تولید پاسخ به زبان هدف، استدلال مبتنی بر…