پرش به محتوای اصلی

موضوع

عامل‌محور

Autonomous agents, tool use, planning, multi-step workflows

۳٬۵۰۸ مقاله منتشر شده

گزارش arxiv: مدل‌های دنیای قابل‌اجرا ۷ بازی پیچیده ARC-AGI-3 را حل کردند

گزارش arxiv: مدل‌های دنیای قابل‌اجرا ۷ بازی پیچیده ARC-AGI-3 را حل کردند

یک سیستم جدید عامل‌محور توانسته است با ساخت و بازنویسی مدل‌های دنیای پایتونی، پازل‌های پیچیده ARC-AGI-3 را حل کند. این دستاورد، معیار جدیدی برای استدلال عمومی در هوش مصنوعی تعریف…

۲ دقیقه خواندن
چرا «وصله‌های حریم خصوصی» در هوش مصنوعی تجسم‌یافته بی‌فایده‌اند؟

چرا «وصله‌های حریم خصوصی» در هوش مصنوعی تجسم‌یافته بی‌فایده‌اند؟

ربات‌های خانگی در حال خروج از شبیه‌سازها و ورود به محیط‌های واقعی هستند، اما سیستم‌های امنیتی فعلی ناکارآمدند. چارچوب جدیدی به نام SPINE پیشنهاد می‌کند که حریم خصوصی به جای یک…

۲ دقیقه خواندن
عبور از دیوار نمایی؛ متد جدید آنوای شاه برای تسخیر بازی‌های پیچیده

عبور از دیوار نمایی؛ متد جدید آنوای شاه برای تسخیر بازی‌های پیچیده

پژوهشگران راهی برای اجرای الگوریتم‌های استاندارد Bandit در مسائل T-MDP یافته‌اند که مانع رشد نمایی حافظه می‌شود. این متد با استفاده از کران‌های اطمینان مشترک، محاسبات را به سطح…

۲ دقیقه خواندن
شکست GPT-5.5 در برابر Gosset؛ پیروزی داده‌های منتخب بر مدل‌های عمومی

شکست GPT-5.5 در برابر Gosset؛ پیروزی داده‌های منتخب بر مدل‌های عمومی

پلتفرم تخصصی Gosset در شناسایی داربست‌های دارویی سرطان و ایمنی، ۳.۲ برابر موفق‌تر از GPT-5.5 عمل کرد. این نتیجه ثابت می‌کند که شاخص‌های داده‌ای منتخب، بر جستجوی عمومی مدل‌های…

۲ دقیقه خواندن
Strat-Reasoner؛ پایان شکست‌های مدل‌های زبانی در بازی‌های استراتژیک

Strat-Reasoner؛ پایان شکست‌های مدل‌های زبانی در بازی‌های استراتژیک

پژوهشگران چارچوب جدیدی به نام Strat-Reasoner معرفی کرده‌اند که به مدل‌های زبانی اجازه می‌دهد فرآیند استدلال رقبای خود را مدل‌سازی کنند. این رویکرد بازگشتی منجر به افزایش ۲۲.۱…

۲ دقیقه خواندن
پایان عصر داده‌های برچسب‌دار؛ چگونه SensingAgents ابهام حسگرها را می‌زداید

پایان عصر داده‌های برچسب‌دار؛ چگونه SensingAgents ابهام حسگرها را می‌زداید

پژوهشگران با معرفی SensingAgents، چارچوبی عامل‌محور ایجاد کرده‌اند که تشخیص فعالیت‌های انسانی را از طریق شبیه‌سازی بحث‌های استدلالی بهبود می‌بخشد. این سیستم در حالت Zero-shot،…

۲ دقیقه خواندن