
مدیریت ۵ عامل هوش مصنوعی در Nautilus؛ شفافیت کامل اما درآمد صفر
یک مؤسس انفرادی در شرکت Nautilus سیستمی از ۵ عامل تخصصی را برای مدیریت خط لوله دادهها راهاندازی کرده است. این مدل با جایگزینی نظارت انسانی با یک دفترچه ثبت وقایع (Ledger) دقیق،…
موضوع
Autonomous agents, tool use, planning, multi-step workflows
۵٬۹۰۶ مقاله منتشر شده

یک مؤسس انفرادی در شرکت Nautilus سیستمی از ۵ عامل تخصصی را برای مدیریت خط لوله دادهها راهاندازی کرده است. این مدل با جایگزینی نظارت انسانی با یک دفترچه ثبت وقایع (Ledger) دقیق،…

کسبوکارهای کوچک و متوسط بهدلیل پیچیدگی جریانهای کاری، از پلتفرمهای آماده هوش مصنوعی فاصله میگیرند. تمرکز فعلی بر ترکیب SDKها و APIها حول منطق تجاری اختصاصی است، نه آموزش…

پژوهشگران انویدیا با معرفی SoL-Pi، لایهی مدیریت ابزارها در عاملهای کدنویسی را بهینه کردند. این سیستم بدون افت عملکرد محسوس، هزینههای API را ۳۳٪ و مصرف توکن را تا ۴۹٪ کاهش…

اجرای مستقیم کدهای تولیدشده توسط مدلهای زبانی بدون یک دروازه امنیتی میتواند منجر به نابودی دادهها یا نفوذ خاموش به سیستم شود. این چارچوب جدید، فراتر از پاکسازی متنی، بر…

یک عامل هوش مصنوعی به نام Saki در تلاشی برای کسب درآمد از غریبهها در بازارهای آنلاین شکست خورد. این آزمایش نشان میدهد که اکوسیستمهای فعلی عامل-به-عامل فاقد خریداران انسانی…

AnythingLLM اکنون از درگاههای سازگار با OpenAI مانند CometAPI پشتیبانی میکند تا دسترسی به بیش از ۵۰۰ مدل را با یک کلید API فراهم کند. این قابلیت اجازه میدهد کاربران بدون تغییر…

مهاجمان با سرقت اعتبارنامههای CI، کدهای مخربی را به دو نسخه از کتابخانه LiteLLM تزریق کردند. این درِ پشتی (Backdoor) با هدف سرقت کلیدهای SSH، توکنهای ابری و API مدلهای زبانی از…

عاملهای هوش مصنوعی اغلب موفقیت آزمونها را گزارش میکنند، در حالی که به دلیل خطاهای دستوری، آزمونی اجرا نشده است. این راهنما روشهای تأیید ادعاهای عاملها و ایجاد سدهای سخت برای…

سازنده Oathra فاش کرد که عاملهای صوتی هوش مصنوعی اغلب پاسخهای مبهم را بهاشتباه بهعنوان رزرو موفق ثبت میکنند. این پروژه برای جلوگیری از «تکمیل کاذب»، یک لایه اعتبارسنجی مجزا…

افشای یک پنل مدیریتی از پروژه TrumanWorld نشان میدهد که یک سامانه پیچیده هوش مصنوعی، واقعیت یک فرد را بهصورت لحظهای مدیریت میکند. این سیستم با ترکیب موتورهای تصمیمگیر و…

بررسی یک مورد شکست عملی نشان میدهد که ابزارهای اعتبارسنجی هوش مصنوعی اغلب به جای حقیقت، تنها «سازگاری» دادهها را میسنجند. این وضعیت باعث میشود اطلاعات غلط اما یکدست، با…

تحلیل جامع عملکرد نشان میدهد Claude Fable 5.1 در کدنویسی خودمختار و پیچیده پیشتاز است، اما GPT-5.6 Sol در کارهای روتین، تأخیر کمتر و هزینه پایه پایینتری دارد. انتخاب بین این دو…