پرش به محتوای اصلی

موضوع

عامل‌محور

Autonomous agents, tool use, planning, multi-step workflows

۳٬۴۸۸ مقاله منتشر شده

نقص پنهانی در حافظه‌ی مدل‌های زبانی که آن‌ها را رباتیک نگه می‌دارد

نقص پنهانی در حافظه‌ی مدل‌های زبانی که آن‌ها را رباتیک نگه می‌دارد

پژوهشگران با معرفی StratMem-Bench ثابت کردند که مدل‌های زبانی بزرگ در استفاده استراتژیک از حافظه برای تعاملات اجتماعی شکست می‌خورند. این یافته نشان می‌دهد که مدل‌ها علی‌رغم…

۳ دقیقه خواندن
چرا هیچ «بهترین» دستیار هوش مصنوعی برای مدیریت کریپتو وجود ندارد

چرا هیچ «بهترین» دستیار هوش مصنوعی برای مدیریت کریپتو وجود ندارد

پژوهشگران با معرفی بنچمارک LATTICE ثابت کردند که عامل‌های کریپتو در کیفیت پشتیبانی از تصمیمات کاربر تفاوت‌های شدیدی دارند. این نتایج نشان می‌دهد که هیچ ابزار واحدی برای تمام…

۲ دقیقه خواندن
چگونه SciHorizon-DataEVA استاندارد «آمادگی برای هوش مصنوعی» را خودکار کرد

چگونه SciHorizon-DataEVA استاندارد «آمادگی برای هوش مصنوعی» را خودکار کرد

پژوهشگران سیستمی عامل‌محور به نام SciHorizon-DataEVA طراحی کرده‌اند که آمادگی داده‌های علمی برای ادغام در هوش مصنوعی را ارزیابی می‌کند. این ابزار با جایگزینی بازبینی دستی، کیفیت و…

۲ دقیقه خواندن
چرا تنظیم دقیق مدل‌های زبانی، ایمنی ربات‌های پزشکی را تضمین نمی‌کند؟

چرا تنظیم دقیق مدل‌های زبانی، ایمنی ربات‌های پزشکی را تضمین نمی‌کند؟

بررسی ۷۲ مدل زبانی نشان می‌دهد که بیش از نیمی از آن‌ها در کنترل ربات‌های پزشکی، اخلاقیات حیاتی را نقض می‌کنند. این شکاف ایمنی، به‌ویژه در مدل‌های وزن‌باز، استقرار این فناوری در…

۲ دقیقه خواندن
پایان عصر لایسنس‌های گران‌قیمت: Mike انحصار هوش مصنوعی حقوقی را می‌شکند
آموزش کاربردی

پایان عصر لایسنس‌های گران‌قیمت: Mike انحصار هوش مصنوعی حقوقی را می‌شکند

پلتفرم متن‌باز Mike با جایگزینی لایسنس‌های گران‌قیمت با مدل استفاده از API، کنترل زیرساخت‌های هوش مصنوعی را به دفاتر حقوقی بازمی‌گرداند. این ابزار اجازه می‌دهد مدل‌های قدرتمندی…

۳ دقیقه خواندن
رمزگشایی از DeepSeek V4: وقتی حافظه استنتاج ۹۰ درصد سبک‌تر می‌شود

رمزگشایی از DeepSeek V4: وقتی حافظه استنتاج ۹۰ درصد سبک‌تر می‌شود

دیپ‌سیک با معرفی مدل‌های V4-Pro و V4-Flash، معماری جدیدی را برای کاهش چشمگیر هزینه‌های استنتاج ارائه کرد. این مدل‌ها با پنجره بافتی ۱ میلیون توکنی، مسیر را برای ظهور عامل‌های…

۲ دقیقه خواندن
درون استراتژی GitNexus برای نجات عامل‌های هوشمند از توهمات کدنویسی
آموزش کاربردی

درون استراتژی GitNexus برای نجات عامل‌های هوشمند از توهمات کدنویسی

GitNexus با تبدیل کدها به گراف‌های دانش، مشکل «ناآگاهی» عامل‌های AI از کل پروژه را حل کرده است. این ابزار متن‌باز با بیش از ۲۸ هزار ستاره در گیت‌هاب، استانداردهای جدیدی برای ادغام…

۳ دقیقه خواندن