پرش به محتوای اصلی
پرش به محتوای مقاله

«سرقت سیستماتیک»؛ اتهام هنرمندان به گوگل و Anthropic در پرونده‌های جدید

·۷ مرداد ۱۴۰۵۵ دقیقه مطالعه۱ بازدید
هنرمندان علیه محتوای بی‌کیفیت هوش مصنوعی وکیل می‌گیرند و برخی حتی پیروز می‌شوند
هنرمندان علیه محتوای بی‌کیفیت هوش مصنوعی وکیل می‌گیرند و برخی حتی پیروز می‌شوند
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر محوریت دعواها از «نقض کپی‌رایت ساده» به «نقض شرایط خدمات (TOS)»؛ به این معنا که حالا هنرمندان سعی می‌کنند حتی از طریق قوانین داخلی خودِ شرکت‌ها، آن‌ها را به تله بیندازند.

تصور کنید حاصل شش سال تحقیق، شب‌زنده‌داری و تالیف شما، بدون اجازه و در یک چشم‌به‌هم‌زدن توسط یک ماشین بلعیده شود تا دیگران بتوانند محتوایی شبیه به اثر شما تولید کنند. این کابوس اکنون برای صدها نویسنده و هنرمند به واقعیتی تبدیل شده که آن‌ها را به درب دادگاه‌ها کشانده است.

شرکت‌های «به‌شدت ثروتمند» تکنولوژی اکنون با مقاومت جدی تولیدکنندگانی روبرو هستند که دیگر اجازه نمی‌دهند آثارشان در مجموعه‌داده‌های دزدی‌شده قرار گیرد. طبق گزارش‌های حقوقی، نویسندگانی چون کرک والاس جانسون در پیشانی این موج حقوقی برای مقابله با تصاحب آثار زندگی‌شان توسط آزمایشگاه‌های هوش مصنوعی هستند.

خالقان دیگر تنها به شکایت از «زباله‌های تولیدی هوش مصنوعی» بسنده نمی‌کنند؛ آن‌ها از سیستم قضایی برای ایجاد حفاظ‌های قانونی استفاده می‌کنند. مرکز این درگیری این است که آیا آموزش یک مدل زبانی بزرگ (LLM) — مثلاً مانند کتابخانه‌داری که میلیاردها صفحه را خوانده و حالا با همان لحن کتاب‌ها جواب می‌دهد — بر اساس متون و هنرهای دارای کپی‌رایت، مصداق «استفاده منصفانه» است یا یک سرقت سازمان‌یافته.

در ژانویه ۲۰۲۳، سارا اندرسن و گروهی از تصویرگران، یک شکایت جمعی علیه Stability AI، Midjourney، DeviantArt و Runway AI ثبت کردند. این پرونده زمانی شروع شد که هوش مصنوعی زاینده (Generative AI) تنها یک کنجکاوی فنی بود، اما امروز این فناوری‌ها به ستون‌های امنیت ملی تبدیل شده‌اند. همان‌طور که در تحلیل‌های پیشین ما درباره‌ی امنیت داده‌های آموزشی اشاره کردیم، نبودِ شفافیت در منشأ داده‌ها، همواره پاشنه آشیل این مدل‌ها بوده است. اکنون هنرمندان دایره حملات خود را به متا (Meta)، گوگل و آنتروپیک (Anthropic) گسترش داده‌اند.

زمینه و جزئیات درگیری

کشف حضور این آثار در مجموعه‌داده‌های آموزشی اغلب به صورت تکان‌دهنده اتفاق می‌افتد. جانسون زمانی متوجه این موضوع شد که مجله The Atlantic یک مجموعه‌داده قابل جستجو از آثاری که برای آموزش هوش مصنوعی استفاده شده بود، منتشر کرد. او با جستجو در این فهرست دریافت که کتاب‌های غیرداستانی‌اش، از جمله The Feather Thief و The Fishermen and the Dragon، به صورت غیرقانونی دزدیده شده‌اند. این‌ها آثاری بودند که او پنج تا شش سال تمام را صرف تحقیق، نوشتن و بررسی آن‌ها کرده بود.

برای سارا اندرسن، این نبرد درباره پاک شدن هویت است. او کمیک‌های وب خود با نام Sarah’s Scribbles را «نتیجه‌ای پیچیده» از تحصیلاتش، تأثیرات دوران کودکی و تصمیمات کوچک زندگی‌اش توصیف می‌کند. او استدلال می‌کند که هوش مصنوعی تمام این مسیر زندگی و تلاشات او را به یک الگوریتم ساده تقلیل می‌دهد.

جانسون وضعیت فعلی توسعه هوش مصنوعی را به یک فرآیند هرج‌ومرج‌آمیز تشبیه می‌کند. او در اظهارنظری گفت: «به نظر نمی‌رسد این اتوبوس توسط گروهی از افراد عاقل، هوشیار و متفکر رانده شود، اما نکته اینجاست که همه ما در این اتوبوس گیر افتاده‌ایم.»

هنرمندان علیه محتوای بی‌کیفیت هوش مصنوعی وکیل گرفته‌اند و برخی حتی پیروز می‌شوند

جنگ بر سر «شرایط خدمات»

سام کوگون، موسیقی‌دان، حمله حقوقی متفاوتی را علیه موتور موسیقی لیریا (Lyria) متعلق به گوگل رهبری می‌کند. بر خلاف شکایت‌های رایج کپی‌رایت، کوگون ادعا می‌کند گوگل با استفاده از داده‌های یوتیوب و سیستم Content ID برای آموزش ProducerAI، شرایط خدمات (TOS) خود را نقض کرده است.

گوگل در درخواست رد شکایت خود ادعا کرده که شرایط یوتیوب به شرکت حق گسترده‌ای برای «بازتولید، توزیع و تهیه آثار مشتق‌شده» می‌دهد. کوگون این رویکرد را یک «فریب و جایگزینی» (bait and switch) می‌نامد و اشاره می‌کند که این قراردادها از نوع «بپذیر یا برو» (take-it-or-leave-it) هستند و هیچ جای چانه‌زنی برای کاربر ندارند.

در این بحث سه نکته کلیدی وجود دارد:

  • شکاف زمانی: کوگون استدلال می‌کند فناوری‌هایی که هنگام آپلود ویدیوها حتی «ذره‌ای در چشم کسی» (خیالی در ذهن کسی) نبودند، اکنون به عنوان داده‌های مجاز برای آموزش مدل‌ها تلقی می‌شوند.
  • دام حقوقی: کریستل دلگادو، وکیل پرونده، اشاره می‌کند که شرایط یوتیوب یک «مجوز دائمی و غیرقابل بازگشت» ایجاد می‌کند، به این معنی که کاربران هرگز نمی‌توانند آن حقوق را پس بگیرند.
  • قصد کاربر: دلگادو تأکید می‌کند هیچ‌کس با این تصور در یوتیوب فعالیت نمی‌کند که در حال واگذاری حقوق خود برای بازسازی محتوایش توسط یک ماشین است.

هنرمندان علیه محتوای بی‌کیفیت هوش مصنوعی وکیل می‌گیرند و برخی حتی پیروز می‌شوند

هزینه انسانی الگوریتم‌ها

برای نویسندگانی چون آندریا بارتز، شاکی اصلی پرونده علیه آنتروپیک، موضوع عمیقاً احساسی است. این تلاش‌ها بخشی از یک روند گسترده‌تر برای رسیدگی به خسارات است، چنان‌که آنتروپیک پیش‌تر برای پایان دادن به پرونده‌های مشابه سرقت کتاب‌های دارای کپی‌رایت، مبلغ ۱.۵ میلیارد دلار پرداخت کرد. بارتز که برای رمان‌هایی چون We Were Never Here و The Spare Room شناخته می‌شود، پس از کشف اینکه رمان‌هایش میان میلیون‌ها کتاب دزدی‌شده برای آموزش مدل‌ها بوده‌اند، احساس «تجاوز، شوک و هشدار» را توصیف می‌کند.

جانسون نیز هنگام کشف این سرقت، «کوکتلی» از احساسات را تجربه کرد: خشمی شدید بابت جسارت شرکت‌ها، نگرانی برای آینده نویسندگان و عطشی برای انتقام. او به دلیل همین احساسات با شرکت حقوقی Susman Godfrey تماس گرفت، زیرا این شکایت را به مثابه یک «انگشت وسط» از طرف تمام کسانی می‌دید که سعی کرده‌اند چیزی خلق کنند.

از نظر کوگون، تولید موسیقی جعلی «ضدانسانی‌ترین» کار ممکن است. او معتقد است این ابزارها هنر حرفه‌ای را بی‌ارزش کرده و باعث می‌شوند موسیقی رایگان شود که در نهایت منجر به سلب قدرت و معیشت تعداد کثیری از موسیقی‌دانان خواهد شد.

این وضعیت نشان‌دهنده یک برخورد بنیادین میان فرهنگ «سریع پیش برو» (move-fast) در غول‌های فناوری و فرآیند کند، متفکرانه و تعمدی خلق انسانی است. اکنون دادگاه‌ها موظف‌اند تصمیم بگیرند که آیا یک الگوریتم می‌تواند به قانوناً «روح» یک انسان را به بهای بهره‌وری، هضم و بلعیده کند یا خیر.

اگر دادگاه‌ها به نفع هنرمندان رای دهند، شرکت‌های هوش مصنوعی مجبور به پرداخت هزینه‌های لایسنس بسیار هنگفت یا حذف کامل مدل‌هایی خواهند شد که با داده‌های بدون مجوز آموزش دیده‌اند. در غیر این صورت، اگر غول‌های تکنولوژی پیروز شوند، مفهوم مالکیت فکری برای خالقان اثر عملاً خواهد مرد.

باید منتظر حکم احتمالی در مورد درخواست رد شکایت گوگل در پرونده Lyria بود، زیرا این تصمیم تعیین می‌کند که آیا «شرایط خدمات» می‌توانند بر انتظارات کپی‌رایت در زمینه آموزش هوش مصنوعی اولویت داشته باشند یا خیر.

اگر تولیدکننده محتوا هستید، شرایط خدمات (TOS) پلتفرم‌هایی که در آن‌ها اثر منتشر می‌کنید را بازبینی کنید تا میزان دسترسی آن‌ها به داده‌های شما مشخص شود.

  • روند رسیدگی به درخواست رد شکایت گوگل در پرونده Lyria را دنبال کنید؛ نتیجه این دادگاه تعیین می‌کند که آیا قوانین خدمات می‌توانند جایگزین حقوق کپی‌رایت شوند یا خیر.
  • از ابزارهای Opt-out (در صورت وجود) در پلتفرم‌های هنری برای جلوگیری از خزش داده‌ها توسط مدل‌های هوش مصنوعی استفاده کنید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این پرونده‌ها اعتبار مفهوم مالکیت فکری را در عصر دیجیتال به چالش می‌کشند. اگر استدلال گوگل پذیرفته شود، هر داده‌ای که در محیط‌های ابری آپلود شود، عملاً ملکیتش را برای آموزش مدل‌های آینده از دست می‌دهد.

تأثیر برای ایران

این پرونده‌ها برای تولیدکنندگان محتوای فارسی‌زبان هشدار است که داده‌هایشان در پلتفرم‌های جهانی بدون لایسنس بلعیده می‌شود و راه قانونی برای بازپس‌گیری حقوقشان از این شرکت‌ها وجود ندارد.

·نگاه ما
تحریریه دات‌هوش

این موج از شکایت‌ها نشان می‌دهد که دوره «داده رایگان» برای غول‌های فناوری به پایان رسیده است. احتمالاً شاهد چرخشی در استراتژی شرکت‌ها خواهیم بود تا به جای خزش گسترده (Scraping)، به سمت قراردادهای میلیارد دلاری برای خرید داده‌های باکیفیت حرکت کنند. این یعنی مدل‌های آینده کمتر اما با داده‌های «پاک» و قانونی آموزش می‌بینند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.