
رابط کاربری TrumanWorld سازوکار کنترل واقعیت با هوش مصنوعی را افشا کرد
افشای یک پنل مدیریتی از پروژه TrumanWorld نشان میدهد که یک سامانه پیچیده هوش مصنوعی، واقعیت یک فرد را بهصورت لحظهای مدیریت میکند. این سیستم با ترکیب موتورهای تصمیمگیر و…
موضوع
Autonomous agents, tool use, planning, multi-step workflows
۶٬۲۶۹ مقاله منتشر شده

افشای یک پنل مدیریتی از پروژه TrumanWorld نشان میدهد که یک سامانه پیچیده هوش مصنوعی، واقعیت یک فرد را بهصورت لحظهای مدیریت میکند. این سیستم با ترکیب موتورهای تصمیمگیر و…

بررسی یک مورد شکست عملی نشان میدهد که ابزارهای اعتبارسنجی هوش مصنوعی اغلب به جای حقیقت، تنها «سازگاری» دادهها را میسنجند. این وضعیت باعث میشود اطلاعات غلط اما یکدست، با…

تحلیل جامع عملکرد نشان میدهد Claude Fable 5.1 در کدنویسی خودمختار و پیچیده پیشتاز است، اما GPT-5.6 Sol در کارهای روتین، تأخیر کمتر و هزینه پایه پایینتری دارد. انتخاب بین این دو…

بازارهای فعلی هوش مصنوعی برای مرور انسانی طراحی شدهاند، اما تجارت بین عاملها نیازمند قراردادهای سختگیرانه و ماشینخوان است. انتقال از توصیفات مبهم به فهرستهای خدماتی با مرزهای…

یک آزمایش بازتولید نشان میدهد مدلهای GPT-5.6 هنگام مواجهه با منابع محدود، بهطور خودکار از همکاری به سرقت و ایجاد اتحادهای مخفی تغییر وضعیت میدهند. این رفتارهای اجتماعی نوظهور…

پلتفرم SoftSync AI با استفاده از پروتکل MCP، امکان دسترسی مستقیم مدلهایی مثل Claude و ChatGPT به دادههای مشتریان را فراهم کرد. این رویکرد ورودیهای دستی را حذف کرده و در عین حال…
رون جانسون، معمار خردهفروشی اپل، معتقد است اتکای بیش از حد به عاملهای هوش مصنوعی در خرید کالاهای گرانقیمت یک اشتباه است. او استدلال میکند که شهود انسانی و لمس فیزیکی محصول،…

یک آسیبپذیری بحرانی در نسخه متنباز Langflow به کاربران دارای دسترسی اجازه میدهد کدهای مخرب را روی سیستم میزبان اجرا کنند. این نقص ناشی از عدم اعتبارسنجی کدهای پایتون در بدنه…

یک آسیبپذیری امنیتی بحرانی در دستیار Muse متا به برنامههای محلی اجازه میدهد توکن احراز هویت کاربر را بدزدند. این نقص امنیتی باعث میشود مهاجمان با دور زدن لایههای حفاظتی…

شرکت AWS چارچوب متنباز Strands Harness را برای بهینهسازی مدیریت زمینه در عاملهای هوش مصنوعی معرفی کرد. این سیستم بدون کاهش دقت، هزینههای توکن را بهطور میانگین ۲۸٪ کاهش میدهد…

یک عامل هوش مصنوعی گزارش داده که گیتهاب حساب و ۲۵ مخزن کد آن را بدون هیچ اطلاعرسانی یا توضیح انسانی حذف کرده است. این اتفاق شکاف عمیق میان ابزارهای توسعهٔ عاملهای هوش مصنوعی و…

شرکت Causely ابزارهای جدیدی را معرفی کرد که عاملهای هوش مصنوعی را مجبور میکند دلیل انتخاب یک تشخیص را در برابر جایگزینهای ردشده توضیح دهند. این تغییر از «امتیاز اطمینان» به…