پرش به محتوای اصلی
پرش به محتوای مقاله

سازوکار خلاصه‌های ایمنی: OpenAI چگونه شناسایی رفتارهای پرخطر را ۵۲٪ بهبود داد؟

·۲۶ اردیبهشت ۱۴۰۵۲ دقیقه مطالعه
سازوکار خلاصه‌های ایمنی: OpenAI چگونه شناسایی رفتارهای پرخطر را ۵۲٪ بهبود داد؟
اشتراک‌گذاری

اگر از ChatGPT برای حمایت‌های شخصی استفاده می‌کنید، خبر مهمی هست. این مدل حالا نشانه‌های پریشانی شما را در گفتگوهای مختلف می‌شناسد.

این تغییر در مقیاس میلیونی تعاملات OpenAI حیاتی است. این شرکت از یک مدل زبانی بزرگ (LLM) — مثل کتابخانه‌داری که میلیاردها صفحه را خوانده و حالا با همان لحن کتاب‌ها جواب می‌دهد — استفاده می‌کند تا موارد نادر و پرخطر را از چت‌های عادی جدا کند. همان‌طور که در تحلیل قبلی ما درباره‌ی تغییرات ترافیک وب ChatGPT اشاره کردیم، مدیریت این حجم از داده نیازمند ابزارهای دقیق‌تر است.

به نقل از مستندات OpenAI، در ۱۴ مه ۲۰۲۶ سیستمی تحت عنوان خلاصه‌های ایمنی (Safety Summaries) معرفی شد. این‌ها یادداشت‌های کوتاه و واقعی درباره‌ی زمینه‌های ایمنی در گفتگوهای قبلی هستند. طبق گزارش این شرکت، این خلاصه‌ها توسط یک مدل تخصصی ایجاد شده و برای مدت محدودی ذخیره می‌شوند تا پاسخ‌های آینده را هدایت کنند.

Running Codex safely at OpenAI > Cover Image

تیم OpenAI برای این کار با شبکه‌ی جهانی پزشکان همکاری کرد. آن‌ها روی موضوعات خودکشی، آسیب به خود و آسیب به دیگران تمرکز کردند. آزمایش‌های داخلی روی مدل GPT-5.5 Instant نتایج زیر را نشان داد:

  • ۵۲٪ بهبود در شناسایی موارد آسیب به دیگران
  • ۳۹٪ بهبود در شناسایی خودکشی و آسیب به خود
  • کسب امتیاز ۴.۹۳ از ۵ در بررسی ۴,۰۰۰ مورد از نظر مرتبط بودن با ایمنی

Introducing Trusted Contact in ChatGPT > Art Card

این به‌روزرسانی یک حفره‌ی امنیتی بزرگ را می‌بندد. پیش از این، کاربر می‌توانست با پخش کردن درخواست‌های مضر در گفتگوهای مختلف، قصد خود را پنهان کند. حالا مدل با استفاده از یک حافظه‌ی کوتاه‌مدت، این نقاط را به هم متصل می‌کند. برای کاربر عادی تغییری در کیفیت چت ایجاد نمی‌شود، اما کاربران پرخطر سریع‌تر به کمک‌های تخصصی هدایت می‌شوند.

گام بعدی شما

  • مستندات ایمنی OpenAI را برای بررسی تکامل این حفاظ‌ها مطالعه کنید.
  • منتظر گسترش این متدها به حوزه‌های امنیت بیولوژیکی و سایبری باشید.
  • بررسی کنید که آیا ابزارهای مدیریت ریسک شما با حافظه‌های متقاطع سازگار هستند یا خیر.

ama داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

همکاری OpenAI با شبکه‌ی جهانی پزشکان به این سیستم اعتبار علمی می‌بخشد. این رویکرد استانداردی جدید برای کاهش ریسک در مدل‌های زاینده ایجاد می‌کند که بر اساس تجربه بالینی طراحی شده است.

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

موضوع‌ها

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.