
جهش ۱۵ برابری سرعت جاوا؛ CodeEvolve و عصر بهینهسازی خودکار کد
**CodeEvolve** چارچوبی تکاملی است که با ترکیب **مدلهای زبانی بزرگ** و تحلیل زمان اجرا، کدهای سازمانی را بهطور خودکار بهینه میکند. این سیستم با دستیابی به افزایش سرعت ۱۵.۲۲…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۷۳ مقاله منتشر شده

**CodeEvolve** چارچوبی تکاملی است که با ترکیب **مدلهای زبانی بزرگ** و تحلیل زمان اجرا، کدهای سازمانی را بهطور خودکار بهینه میکند. این سیستم با دستیابی به افزایش سرعت ۱۵.۲۲…

یک مدل محاسباتی جدید با ترکیب یادگیری کتابخانهای و گرافهای ای، در تلاش است تا منطق درونی و شهود موسیقی جاز را رمزگشایی کند. این سیستم به جای پیشبینی سادهی نتها، به دنبال…

پژوهشگران با معرفی VocalParse، تبدیل صدای خواننده به نتهای موسیقی را خودکار کردند. این مدل با بهرهگیری از مدلهای زبانی صوتی بزرگ، مشکل همراستاسازی متن و نت را در سبکهای متنوع…

پژوهشگران با معرفی Dream-MPC، برتری بهینهسازی مبتنی بر گرادینت را در ۲۴ تکلیف کنترل مداوم ثابت کردند. این مدل با ترکیب مدل جهان و منظمسازی عدم قطعیت، کارایی روشهای سنتی را به…

چارچوب RLearner-LLM با معرفی Hybrid-DPO، «سوگیری پرحرفی» را هدف قرار داده تا مدلها به جای فصاحت، بر درستی منطقی تمرکز کنند. این روش باعث بهبود ۶ برابری در مبنیسازی منطقی مدلها…

عامل جدید SADE با پیادهسازی متدولوژیهای کلاسیک سیسکو، توانست در شناسایی ریشه خطاهای شبکه، GPT-5 را با اختلاف چشمگیری شکست دهد. این دستاورد ثابت میکند که نظم در فرآیند استدلال،…

تیم RaguTeam با بهکارگیری یک مجموعه مدلهای متنوع، مقام اول مسابقات SemEval-2026 را به دست آورد. این سیستم با استفاده از GPT-4o-mini به عنوان داور، توانست در تولید پاسخهای…

چارچوب جدید JASTIN به مدلهای زبانی اجازه میدهد تا کیفیت صدا، گفتار و موسیقی را بدون نیاز به آموزشهای خاص و در حالت صفر-شات ارزیابی کنند. این سیستم با دستیابی به دقت در سطح…

معرفی بنچمارک DiffCap-Bench نشان داد که مدلهای تجاری در درک تفاوتهای بصری، فرسنگها از مدلهای متنباز جلوترند. این یافته ثابت میکند که صرفاً بزرگتر کردن مدلها، مشکل استدلال…

چارچوب جدید Pen-Strategist با ترکیب مدل استدلالی و طبقهبندیکننده CNN، توانست در اجرای استراتژیهای تست نفوذ، عملکرد GPT-5 و Claude-4.6 را به شدت پشت سر بگذارد. این دستاورد نشان…

پژوهشگران چارچوب CAR را معرفی کردند؛ سیستمی که به جای شباهت معنایی، بر اساس توانایی سند در افزایش «اطمینان» مدل، رتبهبندی را تغییر میدهد. این رویکرد نویز را در خط لولههای تولید…

پژوهشگران پنجرهای حیاتی در آموزش مدلهای ترنسفورمر کشف کردهاند که تعیین میکند مدل واقعاً استدلال کند یا صرفاً دادهها را حفظ کند. نکتهی غافلگیرکننده این است که زمانبندی…