
کاهش ۳۶ برابری زمان تنظیم شبیهسازهای علمی با لایههای مبنیسازی SIGA
آداپتور جدیدی به نام SIGA با ایجاد یک لایهی «مبنیسازی» از قواعد و حافظه، امکان تعامل عاملهای کدنویسی با شبیهسازهای پیچیده علمی را فراهم میکند. این سیستم در آزمایشهای مربوط…
موضوع
Autonomous agents, tool use, planning, multi-step workflows
۶٬۲۶۹ مقاله منتشر شده

آداپتور جدیدی به نام SIGA با ایجاد یک لایهی «مبنیسازی» از قواعد و حافظه، امکان تعامل عاملهای کدنویسی با شبیهسازهای پیچیده علمی را فراهم میکند. این سیستم در آزمایشهای مربوط…

پروتکل همکاری انسان-عامل (CHAP) یک فضای کاری ساختاریافته برای تبدیل گفتگوهای گذرا با هوش مصنوعی به مدارک قانونی و تصمیمات امضاشده ایجاد میکند. این استاندارد، شکاف میان مدیریت…

یک مطالعه جدید نشان میدهد که بازخوردهای هدفمند کیفیت گزارشهای عاملهای پژوهش عمیق را افزایش میدهد، اما این پیشرفت در دورههای تکرار متوالی پایداری ندارد. این عاملها هنگام رفع…

مدل با وزنهای باز SearchSwarm-30B با درونیسازی «هوش تفویض» در وزنهای خود، محدودیت پنجره متنی را در وظایف پژوهشی پیچیده برطرف کرده است. این مدل قادر است اهداف کلان را به…

پژوهشگران پیشزمینه جدیدی به نام PRIME را شناسایی کردهاند که امکان پیشبینی تقلب در پاداش (Reward Hacking) را پیش از بروز شکست عملی فراهم میکند. این یافته، رویکرد همراستاسازی…

پژوهشگران چارچوب جدیدی برای «طراحی بازگشتی» در هوش مصنوعی معرفی کردند که طی آن مدل DGM توانست نمرات کدنویسی خود را در ۸۰ تکرار، از ۲۰٪ به ۵۰٪ برساند. این مطالعه با ارائه پروتکل…

یک چارچوب جدید هوش مصنوعی میتواند رعایت دستورالعملهای پزشکی را تنها با تحلیل متون نامساختار تأیید کند. مطالعهای در بیمارستان Alessandria موفق شد بدون نیاز به دستورالعملهای…

یک بررسی جامع در arXiv نشان میدهد که مفهوم «خودتوضیحی» (SX) در سیستمهای هوش مصنوعی، علیرغم اهمیت بنیادین، هنوز فاقد پیادهسازی عملی و معیارهای ارزیابی استاندارد است. این پژوهش…

محققان ابزاری به نام PRISM را معرفی کردهاند که میتواند وضعیتهای پنهان مدلهای زبانی را به لیستهای خوانای دستورات تبدیل کند. این فناوری امکان شناسایی اهداف مخفی و تزریقهای…

پژوهشهای جدید نشان میدهد عاملهای هوش مصنوعی در ارزشگذاری داروها، بیش از آنکه با محدودیتهای استدلالی دستوپنجر باشند، با کمبود دادههای باکیفیت مواجهاند. دسترسی به مجموعه…

معماری جدید MedSci Skills با جایگزینی خود-ارزیابی مدلهای زبانی با گیتهای تأیید قطعی، توانست تمام خطاهای تزریقشده در متون بالینی را شناسایی کند. در حالی که مدلهای زبانی معمولی…

یک چارچوب آموزشی جدید با بهرهگیری از تقطیر دانش و بهینهسازی GRPO، مدلی با ۳۲ میلیارد پارامتر را به سطح مدلهای تجاری پیشرو در اتوماسیون کنسولهای ابری رسانده است. این سیستم ضمن…