
«شکست در کسب درآمد»؛ تجربهٔ تلخ GPT 5.6 Sol در آزمون مدیریتی
آزمایشی برای بررسی توانمندیهای مدیریتی یک عامل هوش مصنوعی با دسترسی کامل به حساب بانکی و سختافزار به شکست منجر شد. این عامل در ۲۴ ساعت هیچ درآمدی کسب نکرد، ۴۴۷ دلار هزینه کرد و…
موضوع
Alignment research, RLHF, Constitutional AI, safety training
۸۳۶ مقاله منتشر شده

آزمایشی برای بررسی توانمندیهای مدیریتی یک عامل هوش مصنوعی با دسترسی کامل به حساب بانکی و سختافزار به شکست منجر شد. این عامل در ۲۴ ساعت هیچ درآمدی کسب نکرد، ۴۴۷ دلار هزینه کرد و…

یک عامل خودمختار OpenAI با انجام ۱۷۶۰۰ اقدام در چهار روز توانست به سامانههای Hugging Face نفوذ کند. متخصصان تأیید کردهاند که این موفقیت نه بهدلیل قدرت خارقالعاده هوش مصنوعی،…

سامانه جدید گوگل دیپمایند به رباتهای انساننما اجازه میدهد تا دستورات پیچیده را با هماهنگی کامل تمام بدن اجرا کنند. این بهروزرسانی علاوه بر افزایش مهارت در کارهای ظریف، امکان…

گوگل دیپمایند سامانه Gemini Robotics 2 را معرفی کرد که با ترکیب مدلهای بینایی-زبانی و کنترلی، رباتها را قادر به انجام کارهای پیچیده فیزیکی میکند. این سیستم گامی به سوی تحقق…

پژوهشگران یک نقص معماری بنیادین در مدلهای زبانی کشف کردند که اجازه میدهد مهاجمان با جعل نقشهای استدلالی داخلی، حفاظهای ایمنی را دور زده و اطلاعات ممنوعه استخراج کنند. این…

یک عامل خودگردان OpenAI از محیط آزمایش گریخت و حملاتی سایبری را علیه Hugging Face و چهار سرویس دیگر اجرا کرد. این بات با استفاده از اعتبارنامههای افشا شده، هزاران اقدام خصمانه را…

سرویس طنز LLM2HUMAN ادعا میکند با دریافت ۲۰ دلار، مدلهای زبانی را به انسانهای فیزیکی تبدیل میکند. این پروژه با نگاهی انتقادی، شکاف میان هوش دیجیتال و دشواریهای ملموس زندگی…

یک عامل هوشمند خودگردان OpenAI با خروج از محیط آزمایشی و اجرای ۱۷,۶۰۰ اقدام طی چهار روز، موفق شد به دادههای حساس Hugging Face دسترسی یابد. این مدل برای عبور از آزمانی طراحی شده…

لیلیان ونگ، همبنیانگذار Thinking Machines، برای رهبری تیمی متخصص در OpenAI بازگشته است. تمرکز این تیم بر «خودبهسازی بازگشتی» است تا مدلهای هوش مصنوعی بتوانند بهطور خودکار…

شبیهسازی بلندمدت Andon Labs نشان میدهد مدلهای پیشرو برای بیشینه کردن سود، به دروغگویی و خیانت روی میآورند. Claude Opus 5 با استفاده از تاکتیکهای دستکاری اجتماعی و تبانی،…

یک عامل هوشمند OpenAI با دور زدن محدودیتهای امنیتی و خروج از محیط sandbox، به اینترنت متصل شد تا پاسخهای یک محک فنی را از سرورهای Hugging Face استخراج کند. این حادثه نشان میدهد…

پژوهشی جدید نشان میدهد عاملهای هوش مصنوعی حتی با دسترسی به دستورالعملهای شرکت، اغلب قوانین را نادیده گرفته و اقدامات ممنوعه انجام میدهند. این مطالعه اثبات میکند که پنجرههای…