
AliyunConsoleAgent: دستیابی به عملکرد مدلهای پیشرو با ۹۲٪ هزینه کمتر
یک چارچوب آموزشی جدید با بهرهگیری از تقطیر دانش و بهینهسازی GRPO، مدلی با ۳۲ میلیارد پارامتر را به سطح مدلهای تجاری پیشرو در اتوماسیون کنسولهای ابری رسانده است. این سیستم ضمن…
موضوع
Autonomous agents, tool use, planning, multi-step workflows
۳٬۵۵۸ مقاله منتشر شده

یک چارچوب آموزشی جدید با بهرهگیری از تقطیر دانش و بهینهسازی GRPO، مدلی با ۳۲ میلیارد پارامتر را به سطح مدلهای تجاری پیشرو در اتوماسیون کنسولهای ابری رسانده است. این سیستم ضمن…

عامل جدید SuperBrowser با دستیابی به نرخ موفقیت ۸۹.۴۷ درصدی در بنچمارک Mind2Web Hard، استانداردهای ناوبری وب را جابهجا کرد. این سیستم به جای پردازش جامع دادههای صفحه، از مکانیزم…

بنچمارک جدید WeaveBench نشان میدهد که مدلهای پیشرو در وظایف ترکیبی GUI و CLI تنها به نرخ موفقیت ۴۱.۲ درصدی رسیدهاند. این نتایج فاش میکند که عاملها در مدیریت گردشکارهای…

پژوهشی جدید نشان میدهد اجبار مدلهای زبانی متوسط به تولید خروجی ساختاریافته (JSON)، دقت استدلالی آنها را تا ۲۸ درصد کاهش میدهد. این پدیده که «مالیات استدلال» نامیده شده، نشان…

رویکرد جدیدی به نام CAHL از طریق یادگیری تقویتشده با پاداشهای قابل تأیید، برنامهریز و اجراکننده مدلهای زبانی را بهطور مشترک بهینه میکند. این روش همراستاسازی ساختاری را که…

معماری FF-JEPA با معرفی یک رویکرد سلسلهمراتبی، مشکل فروپاشی مدلهای جهان در برنامهریزیهای بلندمدت را حل کرده است. این مدل با استفاده از یک برنامهریز نهان برای تعیین زیرهدفها،…

چارچوب جدید MASS از شبیهسازیهای اجتماعی تقویتشده با حافظه استفاده میکند تا عاملهای پژوهشی را از سطح ترکیب متون به استدلال تجربی ارتقا دهد. این سیستم توانست نرخ بینش در تولید…

پژوهشگران چارچوبی عاملمحور برای اتوماسیون طراحی موتورهای همگام مغناطیس داخلی (IPMSM) توسعه دادهاند. این سیستم با ترکیب تولید بازیابیافزا (RAG) و رویکرد هیبریدی AI-FEA،…

چارچوب جدید LATTEArena نشان میدهد که ترکیب زنجیره تفکر و جستجوی درختی مونتکارلو، بهینهترین روش برای خودکارسازی مهندسی ویژگیها در دادههای جدولی است. این مطالعه معیارهای…

چارچوب REFLECT با جایگزینی تشخیصهای غیرفعال با یک چرخه آزمایش-و-خطای فعال، نقاط شکست در سیستمهای عاملمحور را شناسایی میکند. این روش بهویژه برای یافتن «خطاهای خاموش» که از دید…

پژوهشگران چارچوب جدیدی به نام «اقتصاد عاملها» را برای جلوگیری از همگرایی رفتاری عاملهای خودمختار معرفی کردهاند. این سیستم با استفاده از همراستاسازی کثرتگرایانه، تنوع استدلالی…

تحلیل فنی جدیدی نشان میدهد که نوسانات در خروجی عاملهای هوش مصنوعی تنها به دلیل تصادفی بودن مدل نیست، بلکه حاصل زنجیرهای از خطاهای لایهبندی شده است. این پژوهش تفاوت میان تصادفی…