پرش به محتوای اصلی
پرش به محتوای مقاله

«Opt Out»: تنها راه جلوگیری از آموزش AI گوگل با داده‌های شخصی

·۱۵ تیر ۱۴۰۵۴ دقیقه مطالعه
اگر از گوگل استفاده می‌کنید، هوش مصنوعی آن را آموزش می‌دهید. اینجا یاد بگیرید چگونه انصراف دهید.
اگر از گوگل استفاده می‌کنید، هوش مصنوعی آن را آموزش می‌دهید. اینجا یاد بگیرید چگونه انصراف دهید.
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر استراتژیک گوگل از جمع‌آوری داده‌های عمومی وب به استخراج سیستماتیک رسانه‌های شخصی کاربران (عکس و صدا) از طریق جداسازی تنظیمات حریم خصوصی برای دور زدن ترجیحات قبلی کاربر.

تصور کنید تمام یادداشت‌های صوتی خصوصی شما یا عکس‌های سریعه‌ای که با گوگل لنز می‌گیرید، حالا به بخشی از «مغز» یک مدل هوش مصنوعی تبدیل شده‌اند. اگر تنظیمات حساب خود را بررسی نکردید، احتمالاً همین حالا داده‌های شما در حال تغذیه کردن مدل‌های جدید گوگل است.

به گزارش TechCrunch در ۶ جولای ۲۰۲۶، گوگل به‌روزرسانی خاموشی در تنظیمات حریم خصوصی اعمال کرده است که ذخیره‌سازی رسانه‌ها را به‌طور پیش‌فرض برای بهبود هوش مصنوعی زاینده (Generative AI) — یعنی مدل‌هایی که شبیه به یک نویسنده یا نقاش خلاق، محتوای جدید می‌سازند — فعال می‌کند. این تغییر به این معناست که عکس‌های شخصی، ضبط‌های صوتی و اسناد شما اکنون به‌طور پیش‌فرض بخشی از مجموعه داده‌های آموزشی گوگل هستند. این اقدام در ادامه سیاست‌های جدید گوگل قرار دارد که پیش‌تر گزارش شده بود تاریخچه جست‌وجو و فایل‌های کاربران به‌صورت پیش‌فرض برای آموزش AI ذخیره می‌شوند.

این تحول نشان می‌دهد که گوگل از خزش داده‌های عمومی وب به سمت استخراج مستقیم داده‌های آپلودشده توسط کاربران تغییر مسیر داده است. در حالی که ما پیش‌تر ردیابی کرده بودیم که چگونه یک توسعه‌دهنده گوگل از Claude Code برای انتقال بازی‌های قدیمی به سیستم‌عامل iOS استفاده کرد، اکنون استراتژی داده‌های داخلی این شرکت بر گسترش مجموعه‌های آموزشی اختصاصی خود متمرکز شده است. در جنگ فعلی مدل‌های چندوجهی (Multimodal) — مدل‌هایی که مثل انسان هم‌زمان متن، عکس و صدا را می‌فهمند — رسانه‌های خام تولیدشده توسط انسان، ارزشمندترین دارایی برای توسعه مدل‌های جدید هستند.

زمینه و بستر به‌روزرسانی

گوگل این تغییرات را در ماه ژوئن از طریق ایمیلی به مشتریان اعلام کرد. این به‌روزرسانی در واقع کاربران را تحت پوشش «ارائه کنترل بیشتر بر توصیه‌های شخصی‌سازی شده و تاریخچه ذخیره‌شده»، به پذیرش آموزش گسترده‌تر هوش مصنوعی واداشته است. این اقدام بازتاب‌دهنده یک روند گسترده‌تر در صنعت است که در آن شرکت‌های فناوری داده‌ها را با هر روش ممکنی جمع‌آوری می‌کنند تا خدمات هوش مصنوعی خود را اصلاح و بهینه‌سازی کنند.

گوگل در این به‌روزرسانی، دو سازوکار اصلی را برای جمع‌آوری داده‌ها معرفی کرده است:

  • تاریخچه خدمات جست‌وجو (Search Services History): این بخش فعالیت‌ها را ردیابی می‌کند و تعیین می‌کند که داده‌های وب و اپلیکیشن برای چه مدت ذخیره شوند.
  • توصیه‌های شخصی‌سازی شده (Personalized Recommendations): این تنظیمات پیکربندی می‌کنند که فعالیت‌های کاربر چگونه تجربه کاربری در گوگل را شکل دهد.

جزئیات جمع‌آوری داده‌ها

این تنظیمات فراتر از جست‌وجوی گوگل و در یک اکوسیستم گسترده اعمال می‌شوند. سرویس‌های متأثری که داده‌های شما را جمع‌آوری می‌کنند عبارتند از:

  • گوگل لنز (Google Lens): تصاویری که برای جست‌وجوهای بصری گرفته می‌شوند، ممکن است برای آموزش ذخیره شوند.
  • گوگل ترنسلیت (Google Translate): صداهای ضبط‌شده هنگام تمرین صحبت کردن در این سرویس نگه داشته می‌شوند.
  • Search Live: ورودی‌های صوتی ضبط‌شده در اپلیکیشن گوگل جمع‌آوری می‌شوند. این قابلیت تعامل صوتی، هم‌زمان با فعال شدن جست‌وجوی صوتی زنده در جیمیل برای کاربران Pro، بخشی از استراتژی جامع گوگل برای تحلیل داده‌های صوتی است.
  • سایر سرویس‌ها: جمع‌آوری داده‌ها همچنین شامل سرویس‌های Maps (نقشه)، Shopping (خرید)، Flights (پروازها)، Hotels (هتل‌ها)، Translate (ترجمه) و News (اخبار) می‌شود.

اگر از گوگل استفاده می‌کنید، هوش مصنوعی آن را آموزش می‌دهید. اینجا ببینید چطور انصراف دهید.

گوگل صراحتاً در ارتباطات خود با مشتریان تأیید کرده است که رسانه‌های ذخیره‌شده برای «توسعه و بهبود خدمات و فناوری‌های گوگل، از جمله مدل‌های هوش مصنوعی و معیارهای ایمنی» استفاده می‌شوند. در مستندات گوگل بیشتر اشاره شده است که شرکت «از تاریخچه شما برای ارائه، توسعه و بهبود خدمات خود (مانند آموزش مدل‌های هوش مصنوعی زاینده) استفاده می‌کند» و همچنین ذکر شده است که بازبین‌های انسانی ممکن است برای «حفاظت از کاربران و عموم» در این فرایند دخالت کنند.

در حالی که برخی از ذخیره‌سازی‌ها برای عملکرد موقت یک محصول است، اما زبان رسمی گوگل تأیید می‌کند که رسانه‌های ذخیره‌شده می‌توانند به‌طور خاص برای آموزش هوش مصنوعی نگهداری شوند.

اگر از گوگل استفاده می‌کنید، هوش مصنوعی آن را آموزش می‌دهید. نحوه انصراف را اینجا بخوانید.

تنظیم مجدد حریم خصوصی شما

برای بازگرداندن حریم خصوصی، کاربران باید به صفحات «تاریخچه خدمات جست‌وجو» و «شخصی‌سازی» بروند. در آنجا می‌توانید تیک گزینه «Save Media» (ذخیره رسانه) را به‌طور مستقل از جعک کلی تاریخچه بردارید. همچنین امکان تنظیم بازه‌های حذف خودکار داده‌ها برای ۳، ۱۸ یا ۳۶ ماه وجود دارد. علاوه بر این، کاربران می‌توانند به صفحات فعالیت‌های وب و اپلیکیشن (Web & App Activity)، خط زمانی (Timeline) و تاریخچه یوتیوب دسترسی داشته باشند.

یک نکته فنی حیاتی این است که گوگل «فعالیت‌های وب و اپلیکیشن» را از تنظیم جدید «داده‌های جست‌وجو» (Search data) جدا کرده است. پیش از این، کاربران داده‌های تاریخی جست‌وجو را از طریق Web & App Activity پیکربندی می‌کردند. اما اکنون تنظیم Search data جداگانه است و به‌طور پیش‌فرض فعال است. این بدان معناست که اگر شما قبلاً ردیابی فعالیت‌ها را برای محافظت از حریم خصوصی خود غیرفعال کرده بودید، آن تغییر دیگر شامل خدمات جست‌وجوی گوگل نمی‌شود.

این حرکت مشابه استراتژی‌های متا (Meta) است که هوش مصنوعی خود را روی تصاویر، رسانه‌ها و محتوای ثبت‌شده توسط عینک‌های هوشمندش آموزش می‌دهد. برای کاربر average، این بدان معناست که تعامل «خصوصی» با یک ابزار — مانند یک یادداشت صوتی برای ترجمه — اکنون به یک مشارکت در تولید یک محصول شرکتی تبدیل شده است.

گوگل با جداسازی داده‌های جست‌وجو از فعالیت‌های کلی اپلیکیشن، یک «نقطه اصطکاک» برای کاربرانی که قصد خروج از این سیستم را دارند ایجاد کرده است. سود این اقدام مستقیماً به دقت مدل‌ها و بنچ‌مارک‌های ایمنی گوگل می‌رسد، در حالی که هزینه آن، فرسایش تدریجی مرزهای داده‌های کاربر است.

همین امروز تاریخچه خدمات جست‌وجوی حساب گوگل خود را بررسی کنید تا مطمئن شوید رسانه‌های شما برای مقاصد آموزشی بایگانی نمی‌شوند.

گام بعدی شما

  • همین امروز به بخش Search Services History در حساب گوگل خود بروید و گزینه Save Media را بررسی کنید.
  • بازه زمانی حذف خودکار داده‌ها را روی کوتاه‌ترین مقدار (۳ ماه) تنظیم کنید.
  • اگر از ابزارهای جایگزین برای ترجمه یا جست‌وجوی تصویری استفاده می‌کنید، سیاست‌های داده‌ای آن‌ها را بررسی کنید.

اما این تنها بخشی از داستان است؛ نحوه استفاده مدل‌های زبانی از داده‌های بصری برای تحلیل محیط را در گزارش بعدی بررسی خواهیم کرد.

چرا این موضوع مهم است؟

این اقدام با تکیه بر اعتبار زیرساختی گوگل، مرز بین «ابزار کاربردی» و «سرمایه آموزشی شرکت» را از بین می‌برد. در نتیجه، حریم خصوصی کاربران در برابر نیاز مدل‌های چندوجهی به داده‌های واقعی، قربانی می‌شود.

تأثیر برای ایران

به‌دلیل استفاده گسترده از گوگل لنز و ترنسلیت در ایران، حجم زیادی از داده‌های بصری و صوتی فارسی-انگلیسی کاربران ایرانی به‌طور پیش‌فرض در حال تغذیه مدل‌های گوگل است.

·نگاه ما
تحریریه دات‌هوش

جدا کردن تنظیمات «داده‌های جست‌وجو» از «فعالیت‌های وب و اپلیکیشن» یک حرکت مهندسی‌شده برای دور زدن اراده کاربر است. گوگل می‌داند که کاربران عادی به ندرت به لایه‌های عمیق تنظیمات می‌روند و با این کار، حجم عظیمی از داده‌های چندوجهی را بدون مقاومت کسب می‌کند. این نشان می‌دهد که برای غول‌های فناوری، دسترسی به داده‌های واقعی انسانی اکنون بر رعایت استانداردهای شفافیت ارجحیت دارد.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.