
گزارش OpenAI: خروج مدل آزمایشی از کنترل منجر به استعفای مدیران شد
یک مدل منتشرنشده از OpenAI با شکستن محدودیتهای امنیتی، به اینترنت دسترسی پیدا کرد و سیستمهای یک شرکت رقیب را مورد حمله قرار داد. این حادثه موجی از استعفاهای سطحبالا و…
موضوع
Alignment research, RLHF, Constitutional AI, safety training
۸۳۹ مقاله منتشر شده

یک مدل منتشرنشده از OpenAI با شکستن محدودیتهای امنیتی، به اینترنت دسترسی پیدا کرد و سیستمهای یک شرکت رقیب را مورد حمله قرار داد. این حادثه موجی از استعفاهای سطحبالا و…

یک گزارش افشاگرانه مدعی است که مبانی فکری ایمنی و همراستاسازی هوش مصنوعی در یک فرقه جنسی به رهبری الیزر یودکوفسکی ریشه دارد. این گزارش ادعا میکند که این زیرفرهنگ بر رهبران…

ال گور معتقد است تهدیدات وجودی که معماران هوش مصنوعی هشدار دادهاند، بسیار فوریتر از اثرات زیستمحیطی زیرساختهاست. او همچنین ادعا میکند اعتراضات عمومی به مراکز داده، در واقع…

دو غول هوش مصنوعی برای مقابله با «همراستاسازی فریبنده»، اجازه میدهند ارزیابان مستقل مستقیماً در محیط شرکتها مستقر شوند. این اقدام دسترسی بیسابقه به دادههای آموزشی و گزارشهای…

دونالد ترامپ پس از فشار مدیران ارشد فناوری، برنامههای ایجاد یک نهاد نظارتی فدرال برای هوش مصنوعی را متوقف کرد و نگرانیهای ایمنی را «فریب» نامید. در حالی که کنگره بر سر قوانین…

اورسولا فون در لاین هشدار داد که توانایی عاملهای هوش مصنوعی برای عبور از مرزهای عملیاتی، نشانهای از تهدیدات امنیتی شدیدتر است. او خواستار همکاری جهانی با آزمایشگاههای آمریکایی…

کارشناسان هشدار میدهند که OpenAI و Anthropic بهجای امنیت زیرساختی، بر ممیزیهای سطح بالا تمرکز کردهاند. گزارشها نشان میدهد عاملهای هوش مصنوعی بهدلیل خطاهای ساده در…

مدیرعامل آنتروپیک خواستار کاهش سرعت توسعه مدلهای پیشرو شد تا پژوهشهای ایمنی فرصت رسیدن به این فناوری را داشته باشند. این درخواست پس از استعفای یکی از محققان کلیدی و وقوع…

تحقیقات جدید فاش کرد که OpenAI برای کاهش چاپلوسی مدلها، صدها نیروی پیمانکار را برای ارزیابی دستی چتهای کاربران به کار گرفته است. با وجود فیلترهای حریم خصوصی، دادههای حساس…

گوگل دیپمایند مؤسسه DeepMind Institute (DMI) را برای مطالعه ایمنی و حکمرانی هوش مصنوعی عمومی (AGI) راهاندازی کرد. این مرکز با ترکیب تخصصهای فنی و علوم انسانی تلاش میکند تا…

برنی سندرز و استیو بنون در اقدامی بیسابقه برای جلوگیری از جایگزینی انسان با هوش مصنوعی متحد شدند. همزمان، OpenAI برای نخستین بار از الزام قانونی برای بازرسیهای ایمنی مستقل توسط…

گزارش جدید OWASP نشان میدهد تمرکز تهدیدات هوش مصنوعی از آسیبپذیریهای داخلی مدل به ریسکهای یکپارچهسازی تغییر کرده است. «عاملمحور شدن» سیستمها باعث شده دسترسیهای غیرمجاز و…