پرش به محتوای اصلی
پرش به محتوای مقاله

یک‌سوم صفحات جدید وب با اثر انگشت هوش مصنوعی منتشر می‌شوند

·۲ شهریور ۱۴۰۵۳ دقیقه مطالعه
افزایش چشمگیر متن‌های هوش مصنوعی در وب پس از عرضه ChatGPT
افزایش چشمگیر متن‌های هوش مصنوعی در وب پس از عرضه ChatGPT
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

شناسایی اثر انگشت‌های زبانی دقیق (مانند جهش ۶۳ درصدی ویرگول اکسفورد) به جای تخمین‌های کلی، روشی کمی برای اندازه‌گیری نفوذ AI در وب ارائه می‌دهد.

تصور کنید هر سه صفحه‌ای که امروز در وب می‌خوانید، احتمالاً توسط انسانی نوشته نشده است. این دیگر یک پیش‌بینی نیست، بلکه واقعیت آماری وب مدرن است.

طبق گزارش مرکز پژوهش‌های پیو (Pew Research Center) که در ۲۴ اوت ۲۰۲۶ منتشر شد، بیش از یک‌سوم صفحات وب انگلیسی‌زبان که پس از عرضه ChatGPT منتشر شده‌اند، نشانه‌های واضحی از نویسندگی ماشین دارند. این تحلیل بر روی نزدیک به نیم میلیون صفحه با استفاده از ابزار تشخیص Open Pangram انجام شده است. این یافته‌ها در راستای یافته‌های اولیه پژوهش پیو است که برای نخستین بار به نفوذ گسترده محتوای سنتتیک در وب اشاره کرد.

این حجم عظیم از محتوای سنتتیک در حالی رخ می‌دهد که وب در حال تغییر بنیادین در نحوه تولید اطلاعات است. همان‌طور که در تحلیل‌های قبلی ما درباره‌ی اقتصاد مدل‌های زبانی اشاره کردیم، تمرکز صنعت از کاهش هزینه‌های استنتاج — مثل زمانی که OpenAI هزینه مدل GPT-5.6 Sol را به ۴ دلار برای هر میلیون توکن ورودی رساند — به حجم خروجی‌هایی تغییر کرده که در حال اشباع کردن اینترنت عمومی هستند. این تغییر در توزیع محتوا با کاهش سهم ترافیک ارجاعی ChatGPT همسو است که نشان می‌دهد کاربران در حال گذار از ابزارهای متمرکز به محیط‌های پراکنده‌تر وب هستند.

هوش مصنوعی زاینده (Generative AI) — شبیه نویسنده‌ای است که میلیاردها متن را خوانده و حالا با ترکیب احتمالی کلمات، متونی شبیه به انسان می‌سازد — اکنون در دامنه‌های مختلف نفوذ متفاوتی دارد:

  • دامنه‌های .com: حدود ۱۰٪ صفحات نشانه‌های AI دارند.
  • دامنه‌های .org: ۴.۶٪ صفحات تحت تأثیر AI هستند.
  • دامنه‌های .edu و .gov: تنها حدود ۱٪ صفحات از این ابزارها استفاده کرده‌اند.

افزایش چشمگیر متن‌های هوش مصنوعی در وب پس از عرضه ChatGPT

به نقل از این گزارش، «اثر انگشت‌های» زبانی خاصی شناسایی شده‌اند که از سال ۲۰۲۳ جهش کرده‌اند. استفاده از ویرگول اکسفورد ۶۳٪ افزایش یافته و خط تیره (em dash) اکنون دو برابر بیشتر دیده می‌شود. کلماتی مثل "delve"، "tapestry" و "pivotal" که محبوب مدل‌های زبانی هستند، بیش از دو برابر تکرار شده‌اند.

افزایش چشمگیر متن‌های هوش مصنوعی در وب پس از عرضه چت‌جی‌پی‌تی

افزایش چشمگیر متن‌های هوش مصنوعی در وب پس از عرضه ChatGPT

بر اساس بررسی منابع متعدد، این روند توسط پژوهش‌های دیگر نیز تأیید شده است. مطالعه‌ای در آوریل ۲۰۲۶ توسط امپریال کالج لندن، اینترنت آرکایو و دانشگاه استنفورد نشان داد که ۳۵٪ از وب‌سایت‌های جدید، به‌طور کامل یا جزئی توسط AI تولید شده‌اند. این پژوهشگران متوجه شباهت معنایی ۳۳ درصدی بیشتر در متون AI و لحنی به‌طور کلی مثبت‌تر شدند.

برای صاحبان کسب‌وکار و بازاریابان، این یعنی «ظاهرِ هوش مصنوعی» در حال تبدیل شدن به یک کالای ارزان و تکراری است. وقتی یک‌سوم وب از ساختارهای مشابه استفاده می‌کند، سرعت تولید محتوا دیگر یک مزیت رقابتی نیست، بلکه باعث از بین رفتن تمایز برند می‌شود.

با این حال، تعریف «متن AI» همچنان مبهم است. تفاوت زیادی میان یک صفحه کاملاً خودکار و پیش‌نویس انسانی که توسط مدل صیقل داده شده، وجود دارد. ابزارهایی مثل Open Pangram تنها تخمین‌های تقریبی می‌دهند و نرخ خطای آن‌ها بالاست. این چالش‌ها ما را به بررسی دقت ابزارهای تشخیص AI در برابر پیچیدگی‌های زبانی نویسندگان انسانی سوق می‌دهد.

در حالی که استیگما یا همان برچسب منفی ابزارهای AI در محیط‌های کاری باقی مانده، صنعت برای یافتن یک نقطه تعادل تلاش می‌کند. بحث‌های اخیر درباره برنامه‌ی Anthropic برای نشان‌گذاری (Watermarking) خروجی‌های مدل Claude، نشان‌دهنده این قطب‌بندی است.

گام بعدی شما

  • در تولید محتوا، از ساختارهای تکراری مدل‌ها (مثل کلمات کلیدی ذکر شده) فاصله بگیرید تا توسط الگوریتم‌های تشخیص محتوا جریمه نشوید.
  • برای تأیید اصالت منابع، به جای ابزارهای تشخیص الگو، به دنبال استانداردهای جدید اثبات منشأ محتوا باشید.
  • بررسی کنید که آیا محتوای تولید شده توسط AI در سایت شما، تمایز برندتان را از رقبایی که از ابزارهای مشابه استفاده می‌کنند، از بین برده است یا خیر.

اما داستان سخت‌افزاری این تحول و فشار بر مراکز داده حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این داده‌ها با تکیه بر اعتبار مرکز پژوهش‌های پیو، نشان می‌دهند که وب در حال تبدیل شدن به یک «اتاق پژواک» از خروجی‌های مدل‌های زبانی است. این اتفاق باعث کاهش اعتماد کاربران به اطلاعات عمومی و تغییر استراتژی‌های سئو در سراسر جهان می‌شود.

تأثیر برای ایران

این روند باعث می‌شود تولیدکنندگان محتوای فارسی که از AI برای ترجمه و بازنویسی استفاده می‌کنند، با خطر تکراری شدن لحن و کاهش رتبه در موتورهای جستجو مواجه شوند.

·نگاه ما
تحریریه دات‌هوش

اشباع وب از محتوای سنتتیک، پارادوکس «سرعت در برابر تمایز» را ایجاد کرده است. وقتی هزینه تولید محتوای باکیفیت (به ظاهر) به صفر می‌رسد، ارزش محتوا دیگر در «تولید» نیست، بلکه در «تأیید انسانی» و «منبع معتبر» تعریف می‌شود. این وضعیت احتمالاً منجر به بازگشت به مدل‌های توزیع محتوای بسته یا خبرنامه‌های شخصی می‌شود تا کاربران از نویز وب فرار کنند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.