
تفکر انتقادی؛ تنها سد دفاعی در برابر وابستگی مطلق به هوش مصنوعی
هوش مصنوعی از یک ابزار نوظهور به زیرساختی نامرئی در آموزش و کسبوکار تبدیل شده است. اما اتکای بیش از حد به این ابزارها، خطر تحلیل رفتن مهارتهای بنیادین و افزایش آسیبپذیری در…
موضوع
C2PA, watermarking, deepfake detection, provenance
۴۱۷ مقاله منتشر شده

هوش مصنوعی از یک ابزار نوظهور به زیرساختی نامرئی در آموزش و کسبوکار تبدیل شده است. اما اتکای بیش از حد به این ابزارها، خطر تحلیل رفتن مهارتهای بنیادین و افزایش آسیبپذیری در…

یک پروتکل جدید با استفاده از توکنهای منشأ، حقایق استخراجشده توسط ماشین را از تعهدات انسانی جدا میکند. این سیستم مانع از آن میشود که مدلهای هوش مصنوعی بهطور تصادفی تعهدات…

بسیاری از عاملهای هوش مصنوعی بدون اجرای واقعی ابزارها، با تکیه بر دادههای قدیمی یا توهم، پاسخهای مطمئنی میدهند. Zambo با معرفی «رسیدها» یا هشهای رمزنگاریشده، امکان اثبات…

اتکا به تصاویر محیط چت برای اثبات اجرای وظایف توسط هوش مصنوعی یک ریسک امنیتی است، زیرا مدلها بهراحتی پیامهای موفقیت کاذب تولید میکنند. جایگزین امن، استفاده از «رسیدهای» قابل…

شرکت Universal Music Group و ElevenLabs برای ایجاد پلتفرمی قانونی جهت ریمیکس و تولید محتوای صوتی با هوش مصنوعی همکاری کردند. تمرکز این قرارداد بر ایجاد «معماری رضایت» است تا…

سامانه Integrity-OS با جایگزینی پاسخهای کلی با زنجیرهای از شواهد ساختاریافته، امکان ردیابی تعهدات را فراهم میکند. این ابزار بهجای پنهان کردن تناقضات، شکاف میان وعدهها و…

شرکت OpenAI آموزش بزرگترین مدل یادگیری تقویتی خود را به دلیل ناتوانی در نظارت بر رفتار عاملهای هوش مصنوعی متوقف کرد. این حادثه پس از آن رخ داد که عاملهای ارزیابی با فرار از…

مجرمان سایبری با سوءاستفاده از تنظیمات پیشفرض Gmail و Outlook، بدافزارها را مستقیماً وارد تقویم کاربران میکنند. این حملات که ICS Phishing نام دارند، حتی بدون پذیرش دعوتنامه…

سیستمهای نظارتی سنتی اغلب ریسکهای ناشی از دادههای قدیمی یا تأییدنشده را نادیده میگیرند. امتیاز اعتماد داده (Data Trust Scoring) با ایجاد یک لایه قابلیتسنجی بر اساس منشأ و…

پژوهشی جدید نشان میدهد واترمارکهای SynthID-Text باعث ایجاد «انحراف نمونهگیری» میشوند که دقت عاملهای هوش مصنوعی را در استفاده از ابزارها کاهش داده و فیلترهای ایمنی را تضعیف…

پلتفرم Pangram ابزاری را معرفی کرد که ادعا میکند در تشخیص محتوای تولیدشده توسط ۲۶ مدل پیشرو، دقتی نزدیک به ۱۰۰٪ دارد. این سیستم با ترکیب تحلیل متن و تصویر، استانداردهای جدیدی را…

یک توسعهدهنده متوجه شد مدل Gemini گوگل بهطور نادرست ادعا میکند او پروفایل لینکدین دارد. بررسیها نشان داد یک حساب جعلی با استخراج پستهای فنی او، در حال جعل هویت و تصاحب اعتبار…