
بازتعریف SFT به عنوان مسئله طراحی توزیع هدف برای بهبود استدلال مدلها
پژوهشگران چارچوب جدیدی به نام Target-SFT معرفی کردهاند که تنظیم دقیق نظارتشده (SFT) را به جای بهینهسازی توابع زیان، به عنوان یک مسئله طراحی توزیع هدف میبیند. این متد با عبور…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۶۱ مقاله منتشر شده

پژوهشگران چارچوب جدیدی به نام Target-SFT معرفی کردهاند که تنظیم دقیق نظارتشده (SFT) را به جای بهینهسازی توابع زیان، به عنوان یک مسئله طراحی توزیع هدف میبیند. این متد با عبور…

پژوهشی جدید نشان میدهد شفافیت بیش از حد در گزارشهای AI میتواند نتیجه معکوس داشته باشد و اعتماد مخاطب را کاهش دهد. کاربران بهجای توضیحات مفصل، تعاملات «جزئیات در صورت تقاضا» و…

سیستم Piper با جداسازی استراتژیهای آموزش از پیادهسازی زمان اجرا، پیچیدگیهای موازیسازی مدلهای عظیم را کاهش میدهد. این سیستم از یک نمایش میانی (IR) مبتنی بر گراف برای اجرای…

چارچوب SECDA-DSE با ادغام مدلهای زبانی بزرگ، فرآیند پیچیده جستوجوی فضای طراحی (DSE) در شتابدهندههای FPGA را خودکار میکند. این سیستم با ترکیب RAG و زنجیره تفکر، نیاز به تخصص…

مدل FADA با یکپارچهسازی تشخیص و تحلیل سونوگرافی جنین در یک خط لوله واحد، امکان تشخیص بالینی آفلاین را روی گوشیهای هوشمند فراهم کرده است. این سیستم با هدف کاهش شکاف تشخیصی در…

یک بنچمارک گسترده نشان میدهد مدلهای زبانی پیشرو در تشخیص مفاهیم ناموجود ناتوان هستند و نرخ توهم آنها در پاسخ به پرسشهای القایی به ۸۶.۷٪ میرسد. این یافته لزوم تغییر تمرکز از…

پژوهشگران با معرفی چارچوب RoboNaldo، رباتهای انساننما را قادر ساختند تا ضربات فوتبال را با سرعت ۱۳.۱ متر بر ثانیه و پایداری بالا اجرا کنند. این سیستم با استفاده از یادگیری…

پژوهشگران الگوریتم GASLoC را برای پیشآموزش غیرمتمرکز مدلهای زبانی معرفی کردهاند که گلوگاههای ارتباطی همگام را حذف میکند. این چارچوب بهویژه در محیطهایی با سختافزارهای متنوع…

پژوهشهای جدید روی مدلهای زبانی چندوجهی نشان میدهد که القای شخصیت در حالی که کیفیت توصیف تصاویر را بالا میبرد، باعث افت عملکرد در وظایف استدلالی دقیق میشود. این مطالعه همچنین…

چارچوب جدیدی به نام Diffusion Forcing Planner (DFP) با جداسازی نویز تاریخچه و آینده، مشکل لرزش مسیر در خودروهای خودران را حل کرده است. این روش به جای کپیبرداری ساده از الگوهای…

پژوهشگران یک مدل متنباز با دقت بسیار بالا برای شناسایی ۳۱ گونه از پستانداران و پرندگان بریتانیا عرضه کردند. این ابزار قصد دارد جایگزین پلتفرمهای تجاری گرانقیمت شود تا…

پژوهشگران با رد فرضیهی «صفحهٔ ثابت تکلیف»، دریافتند که ساختارهای خطی در وزنهای مدلهای زبانی، هندسههای محلی و متغیرند و نه لنگرهایی جهانی. این یافته نشان میدهد که مسیرهای…