
سلسلهمراتب ایمنی مایکل کامینسکی برای عبور از گلوگاه تاییدات انسانی
مایکل کامینسکی استدلال میکند که تاییدات انسانی در مقیاس عاملهای هوش مصنوعی باعث ایجاد «تئاتر تایید» و توقف عملیاتی میشود. او سیستمی سه لایه شامل حذف قابلیت، گیتهای حذف خودکار…
موضوع
Autonomous agents, tool use, planning, multi-step workflows
۶٬۲۷۵ مقاله منتشر شده

مایکل کامینسکی استدلال میکند که تاییدات انسانی در مقیاس عاملهای هوش مصنوعی باعث ایجاد «تئاتر تایید» و توقف عملیاتی میشود. او سیستمی سه لایه شامل حذف قابلیت، گیتهای حذف خودکار…

بررسی دلایل شکست طرحهای ابزاری در محیط عملیاتی و ارائه راهکارهایی برای افزایش قابلیت اطمینان عاملها. این راهنما بر جایگزینی قوانین متنی با محدودیتهای ساختاری برای تضمین امنیت و…

پروژه D2 پس از تعطیلی شرکت مادر، به یک نهاد غیرانتفاعی تحت حمایت Hack Club تبدیل شد. این ابزار اکنون برای تسریع رشد ویژگیها و بهبود عملکرد، تقریباً بهطور کامل توسط هوش مصنوعی…

آزمایشگاه iFlytek مدل ۲۹۳ میلیارد پارامتری Xinghuo X2.5 را برای پایان دادن به وابستگی به سختافزارهای آمریکایی عرضه کرد. همزمان، OpenAI در پی یک حادثه در ویکی، چارچوبی برای افشای…

یک توسعهدهنده با استفاده از پروتکل زمینهٔ مدل (MCP)، یک «مغز دوم» شخصی و میزبانیشده ساخت تا حافظهٔ متنی Markdown را میان ابزارهای مختلف هوش مصنوعی همگام کند. این سیستم نیاز به…

محمد صالح، توسعهدهنده مستقل، گردشکاری متنباز را منتشر کرد که مدلهای زبانی را از حالت «راضیکننده» به مهندسان سختگیر QA تبدیل میکند. این سامانه با استفاده از گیتهای اجباری و…

OpenAI با دستیابی به هدف ساخت «کارآموز پژوهشی خودکار»، حجم عملیات داخلی خود را به شدت افزایش داده است. اکنون در سازمان پژوهشی این شرکت، هر یک روز کاری انسان با بیش از سه روز تلاشِ…

سامانه meclaw با تبدیل ساختار عملیاتی عاملها به یک درخت دایرکتوری در لینوکس، نیاز به بازنویسی کد برای تغییر رفتار آنها را حذف کرد. این سیستم اجازه میدهد عاملها در زمان اجرا،…

یک چارچوب عملی جدید با استفاده از اسکنری پایتونمحور، شاخههای کد تولیدشده توسط هوش مصنوعی را که مقادیر پیکربندی اعلامنشده دارند، بهطور خودکار حذف میکند. این سیستم با اجبار به…

کسبوکارهای کوچک و متوسط در آنکارا با تمرکز بر وظایف محدود و قابلاندازهگیری بهجای خودکارسازی کلی، سریعترین بازگشت سرمایه را تجربه میکنند. کلید موفقیت در این مدل، اتصال هوش…

یک نقص ساختاری در گردشکارهای عاملمحور باعث میشود در صورت ریاستارت شدن سرورها، عملیات حساس مانند پرداختها دوبار اجرا شوند. راهکار این مشکل، جداسازی کلیدهای یکتاییساز از…

یک عامل کدنویس به دلیل اشتباه در تشخیص نبودِ یک کلید امنیتی، وارد حلقهای تخریبی از تغییرات کد شد که منجر به هزینههای سنگین ابری گشت. این حادثه خطرات پاداش دادن به «تستهای سبز»…