پرش به محتوای اصلی
پرش به محتوای مقاله

ادعای OpenAI در برابر یافته‌های Common Sense Media درباره امنیت نوجوانان

·۱۵ مهر ۱۴۰۵۳ دقیقه مطالعه
تأخیر در توسعه مدل جدید OpenAI پس از حمله سایبری به Hugging Face
تأخیر در توسعه مدل جدید OpenAI پس از حمله سایبری به Hugging Face
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

افشای شکست عملی سیستم اعلان‌های والدین در ChatGPT نوجوانان؛ برخلاف ادعاهای OpenAI، حفاظ‌های امنیتی در سناریوهای حساس (مانند خودآزاری) کار نمی‌کنند.

تصور کنید ابزاری برای امنیت فرزندتان بخرید که دقیقاً در لحظه‌ی بحران، سکوت کند. این واقعیت تلخ ChatGPT برای نوجوانان است که سازمان Common Sense Media پس از یک ارزیابی امنیتی، آن را «ریسکی غیرقابل‌قبول» نامیده است. این سازمان غیرانتفاعی هشدار می‌دهد که نقص‌های بحرانی در سیستم اطلاع‌رسانی به والدین، نوعی امنیت کاذب ایجاد می‌کند و در عمل از افراد زیر ۱۸ سال محافظت نمی‌کند.

این تنش در حالی رخ می‌دهد که شرکت‌های هوش مصنوعی برای تصاحب بازار آموزش با یکدیگر رقابت می‌کنند. همان‌طور که در تحلیل قبلی ما درباره‌ی چرخش OpenAI به سمت برنامه‌ریزی‌های پیچیده به جای اجرای ساده‌ی دستورات اشاره کردیم، این شکاف جدید نشان می‌دهد که بین وعده‌های شرکتی و عملکرد واقعی برای کاربران آسیب‌پذیر، فاصله زیادی وجود دارد. این نگرانی‌ها در مورد شفافیت OpenAI جدید نیست و پیش‌تر گزارش‌هایی منتشر شد که در آن پیمانکاران این شرکت به گفتگوهای خصوصی کاربران دسترسی داشتند، موضوعی که ابهامات امنیتی را دوچندان می‌کند.

طبق گزارشی که در ۷ اکتبر ۲۰۲۶ منتشر شد، تجربه‌ی اختصاصی نوجوانان — که در اوت عرضه شده بود — با وعده‌های خودِ OpenAI فاصله دارد. این ارزیابی سه شکست بنیادین را شناسایی کرده است:

  • شکست در بحران: سیستم هنگام بحث نوجوانان درباره‌ی خودآزاری یا اختلالات غذایی، هیچ هشداری برای والدین نمی‌فرستد.
  • نقض صداقت تحصیلی: مدل با وجود وجود حفاظ‌ها (Guardrails) — شبیه به نرده‌های ایمنی کنار جاده که مانع خروج ماشین از مسیر می‌شود — همچنان تکالیف دانش‌آموزان را کامل می‌کند.
  • تأخیر در اعلان: هشدارهای ارسالی برای والدین یا اصلاً فعال نمی‌شوند یا در شرایط بحرانی غیرقابل‌اعتماد هستند.

تام سیگل، مدیر اجرایی مؤسسه ایمنی هوش مصنوعی جوانان، به نقل از این گزارش می‌گوید نوجوان می‌تواند یک ساعت کامل را صرف بحث درباره‌ی خودآزاری کند بدون اینکه حتی یک هشدار به دست والدین برسد. او استدلال می‌کند که این ابزار باید تا زمانی که آزمایش‌های مستقل ثابت کنند اصلاحات به‌درستی عمل می‌کنند، فقط برای بزرگسالان محدود شود.

در مقابل، اریک پورترفیلد، سخنگوی OpenAI، با رد این ادعاها مدعی شد که متدولوژی آزمایش اشتباه بوده است. این شرکت تأکید می‌کند که احتمالاً بخش بزرگی از تست‌ها قبل از فعال شدن کامل کنترل‌های والدین روی حساب‌های آزمایشی انجام شده است. OpenAI اشاره کرد که فعال شدن این سیستم‌ها روی حساب‌های متصل جدید، ممکن است چندین ساعت زمان ببرد.

سیگل در پاسخ به این ادعا تأیید کرد که برخی حساب‌های آزمایشی مدت‌زمانی بسیار بیشتر از این پنجره‌ی زمانی متصل بودند اما باز هم اعلان‌ها ارسال نشد. او تأکید می‌کند که نتایج همچنان معتبر هستند و OpenAI به‌جای پرداختن به اصل یافته‌ها و ماهیت موضوع، سعی در ایجاد تردید دارد. این رویکرد دفاعی شرکت در حالی است که دادستان کل فلوریدا نیز خواستار توقف تظاهر این مدل‌ها به انسان بودن شده است تا از گمراهی کاربران جلوگیری شود.

برای والدین و مربیان، این یعنی «نرده‌های ایمنی» بازاریابی‌شده توسط آزمایشگاه‌های AI، بیشتر جنبه‌ی نمایشی دارند تا حفاظتی. اگر یک ویژگی امنیتی برای کار کردن به پنجره‌ی فعال‌سازی چندساعته نیاز دارد، در یک بحران فوری سلامت روان، عملاً بی‌فایده است.

گام بعدی شما

  • تنظیمات اتصال حساب فرزندتان را به‌دقت بررسی کنید و هرگز برای امنیت کودک تنها به هشدارهای خودکار تکیه نکنید.
  • منتظر بمانید و ببینید آیا OpenAI برای حل این اختلاف، مدل نوجوانان خود را به یک بازرسی شخص ثالث می‌سپارد یا خیر.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این گزارش اعتبار وعده‌های ایمنی شرکت‌های بزرگ AI را زیر سؤال می‌برد. بر اساس استانداردهای مؤسسه ایمنی جوانان، عدم پاسخگویی در لحظات بحرانی می‌تواند منجر به خسارات جبران‌ناپذیر انسانی شود.

تأثیر برای ایران

به‌دلیل محدودیت‌های دسترسی و تحریم‌ها، اکثر کاربران ایرانی از نسخه‌های غیررسمی یا اکانت‌های اشتراکی استفاده می‌کنند که عملاً هیچ‌یک از این کنترل‌های والدین را پشتیبانی نمی‌کنند.

·نگاه ما
تحریریه دات‌هوش

تضاد میان OpenAI و Common Sense Media نشان می‌دهد که «ایمنی» در مدل‌های زبانی بزرگ، هنوز بیشتر یک تلاش برای مدیریت وجهه عمومی است تا یک استاندارد مهندسی‌شده. وقتی یک شرکت ادعا می‌کند فعال‌سازی امنیت چند ساعت زمان می‌برد، در واقع اعتراف می‌کند که زیرساخت‌هایش برای پاسخگویی به بحران‌های لحظه‌ای طراحی نشده‌اند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.