
موبی: اولین چارچوب دودوییسازی برای مدلهای مبتنی بر MoE
پژوهشگران چارچوب موبی را معرفی کردند که اولین راهکار دودوییسازی مخصوص مدلهای زبانی بزرگ مبتنی بر مخلوط کارشناسان است. این چارچوب سه چالش کلیدی را حل میکند و سرعت استنتاج را بیش…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۶۵۶ مقاله منتشر شده

پژوهشگران چارچوب موبی را معرفی کردند که اولین راهکار دودوییسازی مخصوص مدلهای زبانی بزرگ مبتنی بر مخلوط کارشناسان است. این چارچوب سه چالش کلیدی را حل میکند و سرعت استنتاج را بیش…

پژوهشگران مجموعه داده DecompSR را با بیش از ۵ میلیون نمونه منتشر کردند تا توانایی استدلال فضایی ترکیبی مدلهای زبانی بزرگ را بسنجند. یافتهها نشان میدهد این مدلها در تعمیمدهی…

**LLM-HYPER** از مدلهای زبانی بزرگ بهعنوان ابرشبکه (هایپرنتورک) برای تولید پارامترهای تخمینگر نرخ کلیک استفاده میکند. این روش بدون نیاز به آموزش سنتی، دوره شروع سرد تبلیغات…

پژوهشگران تشخیص اسناد را بهعنوان وظیفه رونویسی بازتعریف کردند. آنها **سوگیریهای استقرایی رابطهای** (relational inductive biases) را برای مدلهای ترانسفورمر طراحی کردند که اسناد…

گوگل قابلیت جستجوی زنده مبتنی بر هوش مصنوعی زاینده خود را به بیش از ۲۰۰ کشور و منطقه گسترش داد. این قابلیت از مدل جدید **Gemini 3.1 Flash** برای مکالمات طبیعی چندزبانه بهره…

سیستم EMBER با ترکیب یک شبکه عصبی اسپایکینگ ۲۲۰ هزار نورونی با مدلهای زبانی بزرگ، رفتار خودمختار را بدون نیاز به محرک خارجی ممکن ساخته است. این معماری از صفر وزن یادگرفته و پس از…

روش جدید **RALP** نشان داده است که یادگیری پرامپت میتواند روشهای سنتی بازنمایی گراف دانش را با اختلاف بیش از ۵ درصد شکست دهد. این رویکرد با تبدیل عناصر گراف به سازههای زبانی…

گوگل مدل جدید **Veo 3.1 Lite** را به خانواده محصولات ویدیویی خود اضافه کرد. این مدل با قیمتی کمتر از نیمی از Veo 3.1 Fast عرضه میشود اما سرعت پردازش یکسانی ارائه میدهد.…

گوگل جدیدترین مدل صوتی خود، **جمینای ۳.۱ فلش لایو** (Gemini 3.1 Flash Live) را عرضه کرد. این مدل در معیار ComplexFuncBench به امتیاز ۹۰.۸٪ دست یافته و گفتگوی بلادرنگ را در بیش از…

پژوهشگران KG-Reasoner را معرفی کردند؛ چارچوبی که با یادگیری تقویتی، مدلهای زبانی را برای استدلال چندمرحلهای روی گرافهای دانش آموزش میدهد. این رویکرد در هشت معیار سنجش به…

اوپنایآی نسخه بهروزشده جعبهابزار توسعه agents خود را منتشر کرد. قابلیت محیط ایزوله (sandboxing) و مجموعه ابزار تازهای برای ساخت agents ایمنتر در اختیار توسعهدهندگان سازمانی…

الگوریتم BayMOTH بهطور هوشمند بین استفاده از اطلاعات وظایف مرتبط و جستجوی مستقل سوئیچ میکند. این روش مشکل پرسوجوهای غیربهینه را در شرایط عدم تطابق وظایف حل میکند.