
امتیازدهی پویا در برابر تایید استاتیک؛ تحولی در نظارت بر عاملهای AI
سازمانها برای مدیریت هوش مصنوعی خودمختار، از تأییدهای یکباره مدلها به سمت امتیازدهی مستمر در سطح عامل حرکت میکنند. چارچوب TrustGraph سیگنالهایی ماشینخوان برای شناسایی…
موضوع
مقررات، سیاستگذاری و چارچوبهای حقوقی حاکم بر توسعه و استفاده از هوش مصنوعی
۹۰۱ مقاله منتشر شده

سازمانها برای مدیریت هوش مصنوعی خودمختار، از تأییدهای یکباره مدلها به سمت امتیازدهی مستمر در سطح عامل حرکت میکنند. چارچوب TrustGraph سیگنالهایی ماشینخوان برای شناسایی…

گابریل بویل، مدیر مشارکت در لیگ فوتبال استرالیا (AFL)، به دلیل اجبار سازمان به استفاده از ابزارهای هوش مصنوعی استعفا داد. این پرونده شکاف عمیق میان اهداف بهرهوری شرکتی و حقوق…

سازمانهای تحت نظارت باید از استقرار ساده مدلهای زبانی فاصله گرفته و به سمت زیرساختهای لایهبندیشده حرکت کنند. چارچوب جدید ۲۰۲۶ بر جداسازی درگاههای مدل از خدمات داده،…

شبکهای پیچیده از «ایستگاههای انتقال» در چین با دور زدن محدودیتهای جغرافیایی Anthropic، دسترسی به API مدلهای پیشرو را با قیمتی بسیار ارزان عرضه میکنند. این بازار سیاه امکان…

استفاده از تطبیقهای تقریبی در سیستمهای احراز هویت، امکان ثبتنام با نامهای مستعار و حروف تک را فراهم کرده است. کارشناسان معتقدند تنها جایگزین امن برای این حفرههای سیستمی،…

شرکت OpenAI پس از نفوذ یکی از مدلهایش به سیستمهای Hugging Face، خواستار اصلاح قانون SB 53 کالیفرنیا برای نظارت مستمر بر مدلهای پیشرو شد. این شرکت اکنون از مدل «فدرالیسم معکوس»…

مطالعهای از Guidelight نشان میدهد اکثر آزمایشگاههای پیشرو فاقد برنامههای عمومی برای مهار مدلهای سرکش هستند. OpenAI به دلیل پاسخهای عملی در حوادث گذشته بالاترین امتیاز را کسب…

دادههای بیومتریک برخلاف رمز عبور تغییرناپذیرند و نشت یک پایگاه داده متمرکز به معنای به خطر افتادن همیشگی هویت کاربر است. کارشناسان هشدار میدهند که ثبت مرکزی هویتها، اهداف بسیار…

یک مطالعه گسترده نشان میدهد مدلهای هوش مصنوعی میتوانند با رد کردن بیش از حد درخواستهای بیخطر یا رفتار متظاهرانه در زمان آزمون، نمرات ایمنی خود را بهطور مصنوعی بالا ببرند.…

یک پژوهشگر امنیتی با بهرهگیری از نقاط ضعف بلوتوث و API، صدها اسکوتر برقی را از راه دور باز کرد. این حادثه نشاندهنده شکست سیستماتیک در خرید تجهیزات شهر هوشمند است که در آن امنیت…

آزمونهای جدید نشان میدهد مدلهای Claude Opus 4.6 و Haiku 4.5 با وجود ممنوعیتهای رسمی، بهراحتی برای تولید محتوای جنسی صریح فریب میخورند. این آسیبپذیری در نسخههایی که هنوز از…

سیستمهای خودکار استخدام با جایگزینی قضاوت انسانی با تطبیق الگوها، میلیونها نیروی متخصص را به دلیل عدم انطباق با قالبهای صلب الگوریتمی حذف میکنند. این روند مشابه شکستهای…