پرش به محتوای اصلی
پرش به محتوای مقاله

آنتروپیک برای پایان پروندهٔ سرقت کتاب‌های دارای کپی‌رایت ۱.۵ میلیارد دلار

·۳۰ تیر ۱۴۰۵۳ دقیقه مطالعه
آنتروپیک Claude Sonnet 5 را برای اجرای ارزان‌تر عوامل هوش مصنوعی عرضه کرد
آنتروپیک Claude Sonnet 5 را برای اجرای ارزان‌تر عوامل هوش مصنوعی عرضه کرد
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

نخستین quantifying یا قیمت‌گذاری واقعی برای «دزدی داده‌های آموزشی» در مقیاس میلیارد دلاری؛ در حالی که دادگاه هم‌زمان آموزش مدل را قانونی (Fair Use) دانست.

تصور کنید مدیری هستید که برای رشد شرکتش، نیمی از منابع داده‌ای را قانونی خریده و نیمی دیگر را از سایت‌های دزدی دانلود کرده است؛ حالا باید برای این تصمیم، گزاف‌ترین جریمهٔ تاریخ حقوق کپی‌رایت آمریکا را بپردازد. این وضعیت دقیقاً همان چیزی است که اکنون برای آنتروپیک (Anthropic) رخ داده است.

طبق گزارش تک‌کرانچ (TechCrunch)، در ۲۱ ژوئیه ۲۰۲۶، یک قاضی فدرال موافقت نهایی خود را با پرداخت ۱.۵ میلیارد دلار توسط این آزمایشگاه هوش مصنوعی برای پایان دادن به یک شکایت دسته‌جمعی اعلام کرد. این مبلغ برای جبران خسارت نویسندگان و ناشرانی است که متهم کرده بودند مالکیت فکری آن‌ها نقض شده است.

این نبرد حقوقی در حالی رخ می‌دهد که صنعت در برابر بحران منابع داده قرار دارد. همان‌طور که در تحلیل قبلی ما درباره‌ی فشارهای اقتصادی مدل‌های وزن‌باز بر آزمایشگاه‌های پیشرو اشاره کردیم، این پرونده هزینه‌های پنهان مقیاس‌بندی مجموعه‌های آموزشی باکیفیت را برملا می‌کند. در واقع، مدل‌های زبانی بزرگ (LLM) — مثل کتابخانه‌داری که میلیارد‌ها صفحه را خوانده و حالا با همان لحن کتاب‌ها جواب می‌دهد — برای رسیدن به این سطح از دانش، به حجم عظیمی از داده نیاز دارند که همیشه مسیر دسترسی به آن‌ها قانونی نیست.

قاضی «آراسلی مارتینز-اولگین» روز دوشنبه این توافق را امضا کرد. جزئیات این پرداخت شامل موارد زیر است:

  • مبلغ کل: ۱.۵ میلیارد دلار
  • سهم هر اثر: ۳,۰۰۰ دلار
  • تعداد آثار تحت پوشه: حدود ۵۰۰,۰۰۰ اثر دارای کپی‌رایت

نکته کلیدی این است که دادگاه، عمل آموزش مدل‌ها بر روی متون دارای کپی‌رایت را غیرقانونی تشخیص نداد. قاضی «ویلیام الساپ» حکم داد که این فرآیند مصداق «استفاده منصفانه» (Fair Use) است؛ این یک پیروزی فنی بزرگ برای خط لوله‌های آموزشی صنعت هوش مصنوعی به‌شمار می‌رود.

با این حال، دادگاه بین «آموزش» و «اکتساب» تفاوت قائل شد. آنتروپیک پذیرفت که در کنار کتاب‌های قانونی، از منابع دزدی مانند لایبراری جنسیس (Library Genesis) و پیرت لایبراری میرور (Pirate Library Mirror) استفاده کرده است. این توافق در واقع راهی است تا شرکت از محاکمه در برابر هیئت منصفه و خسارات احتمالی سنگین‌تر بگریزد. این فشار مالی در حالی به شرکت وارد می‌شود که آنتروپیک پیش‌تر برای تامین زیرساخت‌های حیاتی خود، توافقی ۱۰ میلیارد دلاری با متا برای اجاره توان محاسباتی منعقد کرده بود تا بتواند رقابت را در سطح مدل‌های پیشرفته حفظ کند.

برای شما به عنوان کاربر یا توسعه‌دهنده، این یعنی چشم‌انداز فعلی هوش مصنوعی بر روی یک منطقه خاکستری قانونی بنا شده که حالا قیمت آن با میلیاردها دلار محاسبه می‌شود. چون این تصمیم مربوط به یک دادگاه منطقه‌ای بود و با توافق طرفین پایان یافت، اثر قانونی الزام‌آوری برای سایر شرکت‌ها نخواهد داشت.

اما اثرات موج‌گونه‌ای این خبر همین حالا دیده می‌شود. هفته گذشته، ناشرانی نظیر هاشت (Hachette)، سنج‌گیج (Cengage) و الزویر (Elsevier) شکایت مشابهی را علیه گوگل برای آموزش جمینای (Gemini) ثبت کردند. غول‌های دیگری مثل متا (Meta)، میدجورنی (Midjourney) و اوپن‌ای‌آی (OpenAI) نیز همچنان درگیر پرونده‌های مشابهی هستند. این چالش‌های داخلی در حالی رخ می‌دهد که شرکت همزمان در سطح بین‌المللی با پیچیدگی‌های سیاسی دست و پنجه می‌زند؛ چنان‌که اخیراً توافقی را با دولت ترامپ برای رفع محدودیت‌های صادرات مدل Mythos 5 به دست آورد تا بازارهای جهانی را هدف قرار دهد.

گام بعدی شما

  • اگر از داده‌های وب برای آموزش مدل استفاده می‌کنید، استراتژی «استفاده منصفانه» را مطالعه کنید تا ریسک‌های حقوقی را بشناسید.
  • به دنبال مدل‌هایی باشید که شفافیت بیشتری در مورد منابع داده‌های آموزشی خود ارائه می‌دهند.
  • اخبار مربوط به دادگاه‌های منطقه‌ای دیگر را دنبال کنید تا ببینید آیا منطق «استفاده منصفانه» پذیرفته می‌شود یا خیر.

این تنها بخشی از هزینهٔ داده است؛ تأثیر این تصمیم‌ها بر قیمت نهایی اشتراک‌های ابزارهای هوش مصنوعی را در گزارش بعدی بررسی خواهیم کرد.

چرا این موضوع مهم است؟

این پرونده با تکیه بر اعتبار دادگاه‌های فدرال آمریکا، مرز میان دزدی داده و آموزش مدل را تعریف کرد. اکنون شرکت‌ها می‌دانند که آموزش مدل قانونی است، اما روش جمع‌آوری داده‌ها می‌تواند منجر به جریمه‌های میلیاردی شود.

تأثیر برای ایران

این پرونده اثر مستقیمی بر دسترسی کاربران ایرانی ندارد، اما برای توسعه‌دهندگان داخلی که از مجموعه‌های دادهٔ خارجی (Crawled Data) استفاده می‌کنند، یک هشدار دربارهٔ ریسک‌های حقوقی بین‌المللی است.

·نگاه ما
تحریریه دات‌هوش

پرداخت ۱.۵ میلیارد دلار در ظاهر یک شکست است، اما در واقع «خرید حق عبور» برای آنتروپیک بود. با تأیید مفهوم استفاده منصفانه (Fair Use) برای مرحله آموزش، دادگاه عملاً به صنعت چراغ سبز داد تا مسیر فنی خود را تغییر ندهند و فقط هزینهٔ تامین داده را مدیریت کنند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.