پرش به محتوای اصلی
پرش به محتوای مقاله

سونی و وارنر چاپل برای سرقت میلیون‌ها ترانه از آنتروپیک شکایت کردند

·۷ شهریور ۱۴۰۵۵ دقیقه مطالعه۱ بازدید
شکایت سونی و وارنر چاپل از آنتروپیک به دلیل آموزش هوش مصنوعی کلاود با متون ترانه‌ها
شکایت سونی و وارنر چاپل از آنتروپیک به دلیل آموزش هوش مصنوعی کلاود با متون ترانه‌ها
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر استراتژی حقوقی از شکایت علیه شرکت به مسئولیت شخصی بنیان‌گذاران و مدیران ارشد در مورد دزدی داده‌ها.

اگر امروز از Claude برای نوشتن ترانه یا تحلیل شعر استفاده می‌کنید، احتمالاً به زودی با محدودیت‌های شدید یا هزینه‌های لایسنس مواجه خواهید شد. سونی موزیک پابلشینگ و وارنر چاپل موزیک در ۲۸ اوت ۲۰۲۶ شکایتی را علیه آنتروپیک (Anthropic) در دادگاه منطقه شمالی کالیفرنیا ثبت کردند و مدعی شدند این شرکت ده‌ها هزار اثر موسیقی دارای کپی‌رایت را دزدیده است. در این شکایت، نام داریو آمودئی (مدیرعامل) و بنجامین من (بنیان‌گذار) به‌طور شخصی به عنوان متهم ذکر شده است.

به نقل از متن شکایت، این اقدام «یکی از بزرگ‌ترین و آشکارترین سرقت‌های مالکیت معنوی در تاریخ» است. در این پرونده، نام آثار نمادینی چون «Ain’t No Mountain High Enough»، «September»، «Hallelujah»، «Livin’ On a Prayer» و همچنین ترانه‌های تیلور سوئیفت مانند «Paper Rings» ذکر شده است. این نبرد حقوقی در حالی رخ می‌دهد که آزمایشگاه‌های هوش مصنوعی تحت فشار شدید برای شفاف‌سازی منابع داده‌های خود هستند.

این وضعیت شبیه به این است که کسی تمام کتاب‌های یک کتابخانه را بدون اجازه کپی کند و سپس از آن‌ها برای آموزش یک دستیار مجازی استفاده کند. همان‌طور که در تحلیل قبلی ما درباره‌ی امنیت مدل‌های بازمتن اشاره کردیم، وابستگی مدل‌ها به داده‌های مشکوک، آن‌ها را در برابر ریسک‌های سیستماتیک حقوقی قرار می‌دهد. در واقع، مدل زبانی بزرگ (LLM) — مثل کتابخانه‌داری که میلیاردها صفحه را خوانده و حالا با همان لحن کتاب‌ها جواب می‌دهد — در اینجا متهم است که از «دزدیدن» برای یادگیری استفاده کرده است.

چارچوب حقوقی پرونده

طبق گزارش دادگاه، این شکایت شامل چهار اتهام مجزا است. اولین اتهام، نقض مستقیم کپی‌رایت از طریق دانلودهای غیرقانونی (Torrenting) است که هر سه متهم (شرکت و دو بنیان‌گذار) را در بر می‌گیرد. اتهام دوم، بنیان‌گذاران یعنی داریو آمودئی و بنجامین من را به‌طور شخصی به دلیل هدایت این فعالیت‌های غیرقانونی و مشارکت در نقض کپی‌رایت متهم می‌کند.

دو اتهام بعدی مستقیماً متوجه شرکت آنتروپیک است. این موارد شامل نقض مستقیم کپی‌رایت از طریق استخراج داده‌ها (Scraping)، دانلودهای غیرمجاز، اسکن‌های تخریبی و آموزش مدل است. همچنین ادعا شده که شرکت اطلاعات مدیریت کپی‌رایت، مانند نام آهنگسازان و اعلان‌های قانونی که تحت حمایت قوانین فدرال هستند را حذف یا تغییر داده است.

سازوکار دزدی داده‌ها

بر اساس مستندات پرونده، آنتروپیک برای جمع‌آوری داده‌ها از روش‌های تهاجمی استفاده کرده است:

  • دانلودهای بیت‌تورنت: ادعا شده است که بنجامین من در ژوئن ۲۰۲۱ حدود ۵ میلیون کتاب دزدی را از Library Genesis (LibGen) دانلود کرده است. همچنین در ژوئیه ۲۰۲۲، کارکنان شرکت ۲ میلیون اثر دیگر را از Pirate Library Mirror دریافت کردند. شکایت استدلال می‌کند که چون کاربران بیت‌تورنت هنگام دانلود، فایل‌ها را آپلود می‌کنند، این اقدام حق انحصاری توزیع ناشران را نقض کرده است.
  • استخراج وب: ناشران مدعی‌اند آنتروپیک متون ترانه‌ها را از سایت‌های دارای لایسنس مانند MusixMatch و LyricFind استخراج کرده و شرایط خدمات (Terms of Service) آن‌ها را نقض نموده است.
  • اسکن تخریبی: گزارش شده که شرکت عملیاتی برای دیجیتالی کردن میلیون‌ها کتاب دست‌دوم فیزیکی اجرا کرده و سپس نسخه‌های فیزیکی را نابود نموده است.
  • مجموعه داده‌های شخص ثالث: آموزش مدل بر روی مجموعه‌های داده‌ای چون Common Crawl, The Pile و Books3 متکی بوده است.

آموزش و حفاظ‌ها

ناشران مدعی‌اند مهندسان آنتروپیک از ابزارهای استخراج برای «پاک‌سازی» متن استفاده کرده‌اند تا نام آهنگسازان و اعلان‌های کپی‌رایت را حذف کنند و منبع داده‌ها را پنهان نمایند. این فرآیند باعث شد Claude ترانه‌هایی مثل «All I Want for Christmas is You» و «Eye of the Tiger» را به‌طور کامل حفظ کند.

اگرچه آنتروپیک حفاظ‌ها (Guardrails) — شبیه به نرده‌های ایمنی در لبه یک پل که مانع سقوط کاربر می‌شود — را برای جلوگیری از بازتولید متون کپی‌رایت اجرا کرده است، اما شکایت ادعا می‌کند این موانع به‌راحتی دور زده می‌شوند. کاربران می‌توانند با تغییر در مهندسی پرامپت (Prompt Engineering) — هنر سؤال درست پرسیدن برای گرفتن بهترین جواب — مدل را مجبور به تولید متون کلمه به کلمه یا آثار مشتق شده «به سبک» آهنگسازان خاص کنند. این چالش‌ها در حالی رخ می‌دهد که آنتروپیک هم‌زمان بر روی توسعه‌ی سیستم‌های برچسب‌گذاری نامرئی برای محتواهای تولید شده توسط کلود تمرکز کرده تا شفافیت خروجی‌ها را افزایش دهد.

علاوه بر این، ناشران استدلال می‌کنند که توانایی Claude در نوشتن ترانه‌های جدید، جایگزینی برای آثار اصلی در بازار ایجاد می‌کند. این موضوع مستقیماً با کاتالوگ‌های ناشران رقابت کرده و باعث کاهش استخر حق‌الامتیاز استریمینگ (Streaming Royalty Pools) می‌شود که برای پرداخت به آهنگسازان استفاده می‌گردد. این نگرانی‌ها با یافته‌های اخیر ابزارهای تشخیص هوش مصنوعی هم‌سو است؛ برای مثال، ابزار Treblo اخیراً فاش کرد که یکی از آهنگ‌های برتر بیلبورد توسط هوش مصنوعی ساخته شده بود که نشان‌دهنده نفوذ عمیق این فناوری در صنعت موسیقی است.

سابقه پرونده بارتز

بسیاری از ادعاهای این پرونده بر اساس یافته‌های پرونده Bartz v. Anthropic است. در آن پرونده که یک شکایت دسته‌جمعی بود، دادگاه دانلودهای آنتروپیک را «دزدی مستقیم در مقیاس عظیم» توصیف کرد و شرکت در سپتامبر ۲۰۲۵ مبلغ ۱.۵ میلیارد دلار برای تسویه پرداخت کرد.

اسناد داخلی فاش‌شده در آن پرونده نشان می‌دهد بنجامین من سایت LibGen را «بسیار مشکوک» (sketchy AF) نامیده و تیم آرشیو شرکت اذعان کرده که این سایت «نقض آشکار کپی‌رایت» است. در یک سند برنامه‌ریزی سال ۲۰۲۴ درباره عملیات اسکن کتاب‌ها آمده است: «نمی‌خواهیم کسی بداند ما روی این موضوع کار می‌کنیم».

این شکایت نشان‌دهنده یک چرخش است؛ حالا هدف، جریمه شخصی مدیران ارشد است، نه فقط جریمه مالی شرکت. در متن شکایت آمده است که آمودئی و من به‌طور شخصی مسئول نقش‌هایشان در دانلودهای غیرقانونی از LibGen و PiLiMi هستند.

خسارات و خواسته‌ها

ناشران در صورت اثبات عمدی بودن تخلف، خواستار خسارت قانونی تا ۱۵۰ هزار دلار برای هر اثر هستند. همچنین برای هر مورد حذف اطلاعات مدیریت کپی‌رایت، تا ۲۵ هزار دلار غرامت طلب کرده‌اند.

فراتر از پول، آن‌ها از دادگاه می‌خواهند که آنتروپیک را مجبور کند تمام نسخه‌های متخلف را تحت نظارت دادگاه نابود کند. آن‌ها همچنین درخواست گزارش کاملی از داده‌های آموزشی، متدهای مورد استفاده و ترانه‌های خاصی که برای آموزش مدل‌ها به کار رفته است را داده‌اند.

ناشران که توسط دفاتر حقوقی Oppenheim + Zebrak و Pryor Cashman نمایندگی می‌شوند، اشاره کردند که آثار خود را به شرکت‌های دیگر هوش مصنوعی لایسنس داده‌اند. همان‌طور که در متن شکایت آمده است: «حتی انقلابی‌ترین فناوری‌ها نیز باید در چارچوب قانون توسعه یابند».

برای صنعت هوش مصنوعی، این یک پیش‌قاعده خطرناک است. «پاک‌سازی» داده‌ها برای حذف نشانه‌های کپی‌رایت ممکن است به‌جای بهینه‌سازی فنی، به‌عنوان «پنهان‌کاری عمدی» تلقی شود. این موضوع می‌تواند آزمایشگاه‌ها را مجبور کند بخش‌های عظیمی از داده‌های خود را پاک کنند، مگر اینکه بتوانند زنجیره قانونی مالکیت داده‌ها را اثبات کنند.

منتظر تصمیم دادگاه باشید که آیا درخواست ناشران برای ارائه لیست کامل داده‌های آموزشی و متدهای مورد استفاده برای Claude را می‌پذیرد یا خیر.

گام بعدی شما

  • اگر از مدل‌های AI برای تولید محتوای هنری استفاده می‌کنید، حتماً از ابزارهای تشخیص سرقت ادبی برای بررسی خروجی‌ها استفاده کنید.
  • دنبال کنید که آیا دادگاه درخواست دسترسی به لیست داده‌های آموزشی Claude را می‌پذیرد یا خیر؛ این اتفاق می‌تواند پرده از رازهای بسیاری از مدل‌های دیگر بردارد.
  • بررسی کنید که آیا شرکت‌های AI که با آن‌ها قرارداد دارید، تضمین‌های حقوقی مالکیت معنوی داده‌های آموزشی ارائه می‌دهند یا خیر.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این پرونده اعتبار ادعاهای «استفاده منصفانه» را به چالش می‌کشد و می‌تواند مدل‌های بنیادی را مجبور به پاک‌سازی داده‌های آموزشی خود کند. تخصص حقوقی ناشران در این پرونده، ریسک مالی مدیران AI را به سطح شخصی می‌برد.

تأثیر برای ایران

این خبر اثر مستقیمی بر کاربران ایرانی ندارد، اما برای توسعه‌دهندگان داخلی که از داده‌های وب برای آموزش مدل‌های فارسی استفاده می‌کنند، یک هشدار درباره ریسک‌های مالکیت معنوی است.

·نگاه ما
تحریریه دات‌هوش

جابه جایی هدف از شرکت به مدیران ارشد، یک استراتژی فشار برای مجبور کردن آزمایشگاه‌های AI به پذیرش مدل‌های لایسنس‌دار است. این پرونده ثابت می‌کند که استراتژی «اول آموزش بده، بعد تسویه کن» دیگر پاسخگو نیست و احتمالاً منجر به ایجاد یک بازار رسمی برای خرید و فروش داده‌های آموزشی با کیفیت می‌شود.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.