پرش به محتوای اصلی
پرش به محتوای مقاله

سقوط اعتماد بصری؛ وقتی متخصصان تشخیص جعل عمیق را از دست می‌دهند

·۱۳ شهریور ۱۴۰۵۷ دقیقه مطالعه۲ بازدید
یادداشت
مرد واقعیت: عکسی از یک صفحه نمایش شکسته با پیکسل‌های پراکنده و رنگ‌های اغراق‌شده.
مرد واقعیت: عکسی از یک صفحه نمایش شکسته با پیکسل‌های پراکنده و رنگ‌های اغراق‌شده.
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تأکید بر مفهوم «باور دوگانه»؛ یعنی پذیرش هم‌زمان واقعیت و جعل در ذهن کاربر، که نشان می‌دهد اثر AI از سطح فنی به سطح تغییرات روان‌شناختی در ادراک جمعی رسیده است.

تصور کنید سال‌ها روی ساخت سامانه‌های تشخیص جعل عمیق کار کرده باشید و ناگهان با یک ویدیوی ساده از آغوش یک کوالا و گربه، بفهمید که دیگر نمی‌توانید به چشم‌های خودتان اعتماد کنید. این لحظه، نقطه آغاز یک بحران شناختی است؛ جایی که مرز میان رسانه‌های اصیل و ساخته‌شده برای چشم انسان به‌طور کامل محو می‌شود. نویسنده این تجربه را لحظه‌ای از «ناامیدی معلق» می‌نامد؛ نقطه‌ای که در آن تمایز میان حقیقت و سنتز بصری برای ناظر انسانی عملاً نامرئی شده است.

این وضعیت زمانی رخ می‌دهد که هوش مصنوعی زاینده (Generative AI) — شبیه جادوگری که می‌تواند هر تخیلی را به تصویری باورپذیر تبدیل کند — از مرحله «دره وهمی» (Uncanny Valley) عبور کرده و وارد فاز تولید محتوای بی‌نقص در قالب‌های کوتاه شده است. برای کاربر عادی، این‌ها فقط ویدیوهای جذاب در فید شبکه‌های اجتماعی هستند، اما برای متخصصانی که سال‌ها صرف ساخت سیستم‌های شناسایی جعل عمیق کرده‌اند، این اتفاق به معنای فروپاشی بنیادین شواهد بصری به‌عنوان منبع حقیقت است. همان‌طور که در تحلیل‌های پیشین ما درباره امنیت مدل‌های مولد اشاره کردیم، سرعت تکامل این ابزارها بسیار فراتر از توان تطبیق‌پذیری ادراک انسانی است.

توهم ویدیوهای «بانمک»

داستان با یک کلیپ ساده شروع شد که توسط همسر نویسنده انتخاب شده بود؛ کسی که علاقه شدیدی به محتواهای «بانمک» شامل شخصیت‌های عروسکی و حیوانات دوست‌داشتنی دارد. در این ویدیو، یک ماده‌کوالا به همراه دو توله تازه متولد شده‌اش که در خواب عمیق هستند، روی یک تکه پارچه قرار دارند و مادر به دیواری ساده تکیه داده است.

سپس یک گربه خاکستری-نارنجی (Tabby) جوان و محتاط وارد کادر می‌شود. گربه با وجود ترس و تردید، کنجکاوی‌اش او را به جلو می‌کشد. او در حالی که چشم از مادر کوالا برنمی‌دارد، با احتیاط به توله‌های خوابیده نزدیک می‌شود. پس از حدود یک دقیقه بن‌بست و تردید، مادر کوالا دستش را دراز می‌کند، گربه جوان را در آغوش می‌گیرد و برای لحظاتی او را نگه می‌دارد و در نهایت، این مزاحم کوچک را به‌عنوان یک «مهمان پذیرفته‌شده» در کنار فرزندانش می‌نشاند.

هرچند تعاملات فیزیکی، وزن حیوانات و فیزیولوژی آن‌ها در ویدیو کاملاً سازگار و درست به نظر می‌رسید، اما بستر اتفاق (Context) به‌شدت غیرمحتمل بود. نویسنده در ابتدا از خود پرسید که یک گربه خانگی چگونه می‌تواند به فضایی دسترسی داشته باشد که این حیوانات وحشی در آن هستند، حتی اگر در محیط یک باغ‌وحش باشد. اگرچه او در ابتدا این فکر را با این جمله که «زندگی عجیب است» رد کرد، اما در نهایت او و همسرش به این نتیجه رسیدند که ویدیو احتمالاً توسط هوش مصنوعی ساخته شده است. این نوع محتواهای بصری فریبنده، یادآور روند گسترش تصاویر جعلی حیوانات است که به ابزاری برای کلاهبرداری و تخریب اعتماد دیجیتال تبدیل شده‌اند.

شکست در تشخیص انسانی

نویسنده که هفت سال روی تصاویر ساخته‌شده با AI کار کرده و آثارش در کتابچه کمبریج درباره هوش مصنوعی زاینده و قانون (به‌ویژه در بخش مربوط به وزن‌ها در یادگیری ماشین) چاپ شده، اعتراف می‌کند که اعتمادش به ادراک بصری را کاملاً از دست داده است. او تأکید می‌کند که این یک چالش شخصی نیست، بلکه یک روند مستند در شناخت انسانی است.

بر اساس بررسی‌های پژوهشی، تا اواخر سال ۲۰۲۵، توانایی انسان در تشخیص تصاویر ساخته‌شده توسط AI به ۵۴٪ رسیده است؛ عددی که تقریباً با حدس تصادفی برابری می‌کند و نشان می‌دهد چشم انسان دیگر ابزار قابل اعتمادی برای تفکیک حقیقت از جعل نیست.

چند نکته کلیدی در این زمینه وجود دارد:

  • شکاف توجه: سنتز ویدیو در حال حاضر هنوز در حفظ ثبات (Consistency) در طول زمان مشکل دارد. اما این نقص‌ها برای محتواهای ویروسی کوتاه که دقیقاً با بازه زمانی کوتاه شده‌ی توجه انسان سازگار هستند، هیچ مانعی ایجاد نمی‌کنند و نادیده گرفته می‌شوند.
  • شکاف تخصص: نویسنده متوجه شد حتی پس از سال‌ها مطالعه تخصصی، وقتی تصاویری را برای تشخیص واقعی یا جعلی رتبه‌بندی کرد، نمرات او دقیقاً با میانگین مردم عادی در تست‌های ذکر شده برابر بود.

برای او، این درک ناگهانی شبیه لحظات تاریخی بزرگی بود که جهان را تغییر دادند و او را در جایگاه «کجا بودم» قرار دادند؛ مثل شنیدن خبر مرگ الویس پرسلی از رادیو در حالی که مادرش در حال رنگ کردن سقف بود؛ یا تماشای اولین اکران فیلم جنگ ستارگان در میدان لستر اسکوئر در سال ۱۹۷۷ با صدای رعدآسای استار-دستروریرها؛ یا اکران پارک ژوراسیک در جولای ۱۹۹۳ وقتی تی-رکس حصار خود را شکست؛ و لحظه‌ای که «مارا» به زبان ایتالیایی اعلام کرد اتفاقی در نیویورک در حال رخ دادن است. برای نویسنده، ویدیوی کوالا لحظه‌ای بود که «واقعیت» در آن مُرد.

زیرساخت‌های اعتماد

تلاش‌ها برای مبارزه با این دنیای «پسا-واقعیت» از قضاوت انسانی به سمت اثبات فنی منشأ (Provenance) تغییر جهت داده است. واشینگتن پست یکی از اولین پیش‌بینی‌های این دنیای پسا-واقعیت را در فوریه ۲۰۱۸، اندکی پس از ظهور اولین جعل‌های عمیق مبتنی بر خودرمزگذار (Autoencoder) — سیستمی که اطلاعات را در یک فضای کوچک فشرده و سپس بازسازی می‌کند — منتشر کرد.

این هشدارها منجر به چندین واکنش نظارتی و قانونی شد:

  • قانون‌گذاری: وضع قوانینی که به‌طور خاص جعل‌های عمیق جنسی (Sexual Deepfakes) را هدف قرار می‌دهند.
  • قوانین اتحادیه اروپا: مقررات جدیدی که افشای اجباری محتوای ساخته‌شده با AI را الزامی می‌کند.
  • سامانه C2PA: ایجاد ائتلاف برای اثبات اصالت و منشأ محتوا (Coalition for Content Provenance and Authenticity).

سامانه C2PA تلاش می‌کند یک شناسنامه «از گهواره تا گور» برای تصاویر بسازد. این سیستم سعی می‌کند اطلاعات تأییدشده را از لحظه ثبت توسط سنسور دوربین تا مراحل ویرایش، انتشار و آرشیو به تصویر بچسباند و هر تغییری را در طول این مسیر ثبت کند. با این حال، این سیستم دو مشکل بزرگ دارد: اول اینکه حجم عظیم تصاویر موجود در گردش را نادیده می‌گیرد و دوم اینکه تنها در مکان‌های محدودی که پذیرفته شده است، ارزش مصرف‌کننده دارد.

روان‌شناسی «باور دوگانه»

وقتی بررسی منشأ چیزی را رها می‌کنیم — همان‌طور که نویسنده در مورد ویدیوی کوالا و گربه کرد — وارد وضعیتی می‌شویم که او آن را «باور انعطاف‌پذیر» (Elastic Belief) می‌نامد. این وضعیت بازتابی از شکنجه‌های روان‌شناختی دیستوپیایی است که جورج اورول در رمان ۱۹۸۴ توصیف کرده است.

کجا بودی وقتی واقعیت مرد؟

در اقتباس سینمایی سال ۱۹۸۴، وینستون اسمیت شکنجه‌شده (با بازی جان هرت) شروع به پذیرش این ایده می‌کند که شاید چهار انگشت در واقع سه انگشت باشد. شخصیت ضدقهرمان، اوبراین (با بازی ریچارد برتون)، صراحتاً بیان می‌کند که هدف شکنجه، انعطاف‌پذیر کردن باورهاست. هدف این است که قربانی را مجبور کنند تا در صورت نیاز دولت، به‌طور هم‌زمان دو باور متضاد را در سر داشته باشد.

امروز کاربران در حال عادت کردن به تضاد مشابهی هستند: اینکه یک ویدیو را هم‌زمان هم «ساخته‌شده با AI» و هم «واقعی» بدانند. این انعطاف‌پذیری برای اینفلوئنسرها و بازیگران سیاسی بسیار ارزشمند است، زیرا باعث می‌شود رأی‌دهندگان و مصرف‌کنندگان در برابر کسانی که ادعا می‌کنند با حذف این ادراک دوتایی، «حقیقت» را به آن‌ها می‌گویند، آسیب‌پذیرتر شوند.

پارادوکس نظارتی

امروزه اشتهای زیادی برای نظارت دولتی بر محتوای AI وجود دارد. اما تناقض اینجاست که این درخواست در واقع فراخوانی برای اتوماسیون یا واگذاری قضاوت انسانی است. ما با درخواست از دولت‌ها و نهادها برای برچسب‌گذاری محتوا، در واقع کار تفکر انتقادی را به آن‌ها واگذار می‌کنیم.

این تغییر نشان‌دهنده یک بی‌میلی جمعی برای انجام تلاش‌های شناختی لازم جهت سنجش شواهد است. این موضوع تلویحاً می‌گوید یا مردم دیگر نمی‌خواهند این کار را انجام دهند، یا باور دارند که برخی از افراد نباید اجازه داشته باشند این قضاوت‌ها را انجام دهند؛ دیدگاهی که نویسنده معتقد است به اعتبار کسانی که آن را دارند نمی‌افزاید.

دیدگاه‌های متضاد

البته همه دیدگاه‌ها تیره و تار نیستند. جاشوا هب‌گود-کوت، فیلسوف معروف، در سال ۲۰۲۴ استدلال کرد که «آخرالزمان معرفتی» تا حد زیادی یک بزرگ‌نمایی و هشدار افراطی است. او معتقد است سیستم‌هایی که ما در حال از دست دادن آن‌ها هستیم — مانند اعتماد ذاتی به عکاسی — از ابتدا شکننده بودند و تاریخچه نسبتاً کوتاهی داشتند.

با این حال، هب‌گود-کوت در آثار جدیدتر خود هشدار داد که میم‌های «اخبار جعلی» (Fake News) و «پسا-حقیقت» (Post-truth) اکنون برای اهداف سیاسی به سلاح تبدیل شده‌اند. حتی اگر این موضوع یک فرصت‌طلبی سیاسی باشد تا یک توطئه بزرگ، باز هم باعث تیره و تارتر شدن آب‌های واقعیت عینی می‌شود.

این تسلیم درونی در برابر «نا-واقعیت»، خطری برای توانایی انسان در قضاوت درباره جهان است. خطر اصلی، فقط یک ویدیوی جعلی نیست؛ بلکه عادت به این است که دیگر برایمان مهم نباشد چیزی جعلی است یا نه، و در نتیجه، آسیب‌پذیری در برابر کسانی که ادعای مالکیت حقیقت را دارند.

گام بعدی شما

  • به جای اعتماد به چشم، از ابزارهای بررسی متادیتای تصاویر استفاده کنید.
  • در هر محتوای احساسی، ابتدا «بستر اتفاق» (Context) را به چالش بکشید.
  • یاد بگیرید چگونه نشان‌های C2PA را در پلتفرم‌های پشتیبان شناسایی کنید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره تراشه‌های Blackwell و قدرت پردازش ویدیوهای زنده مراجعه کنید.

چرا این موضوع مهم است؟

این موضوع نشان می‌دهد که تخصص انسانی در تشخیص جعل دیگر کافی نیست و اعتبار بصری به‌عنوان سند قانونی یا خبری فروپاشیده است. اکنون تنها راه نجات، جایگزینی «قضاوت انسانی» با «زنجیره اعتماد فنی» (Technical Provenance) است.

تأثیر برای ایران

به‌دلیل گسترده بودن مصرف محتوای کوتاه در شبکه‌های اجتماعی ایران، این بی‌تفاوتی نسبت به واقعیت می‌تواند نرخ پذیرش اخبار جعلی را در فضای داخلی به‌شدت افزایش دهد.

·نگاه ما
تحریریه دات‌هوش

بحران فعلی دیگر روی کیفیت پیکسل‌ها نیست، بلکه روی «سستی ادراکی» انسان است. وقتی هزینه ذهنی تشخیص حقیقت از جعل بیش از لذت تماشای محتوا شود، جامعه به سمت پذیرش «حقیقت‌های دیکته‌شده» حرکت می‌کند. خطر واقعی AI در تولید محتوای دروغین نیست، بلکه در تخریب ابزار قضاوت انسان است.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.