تصور کنید مدیری هستید که برای رشد شرکتش، نیمی از منابع دادهای را قانونی خریده و نیمی دیگر را از سایتهای دزدی دانلود کرده است؛ حالا باید برای این تصمیم، گزافترین جریمهٔ تاریخ حقوق کپیرایت آمریکا را بپردازد. این وضعیت دقیقاً همان چیزی است که اکنون برای آنتروپیک (Anthropic) رخ داده است.
طبق گزارش تککرانچ (TechCrunch)، در ۲۱ ژوئیه ۲۰۲۶، یک قاضی فدرال موافقت نهایی خود را با پرداخت ۱.۵ میلیارد دلار توسط این آزمایشگاه هوش مصنوعی برای پایان دادن به یک شکایت دستهجمعی اعلام کرد. این مبلغ برای جبران خسارت نویسندگان و ناشرانی است که متهم کرده بودند مالکیت فکری آنها نقض شده است.
این نبرد حقوقی در حالی رخ میدهد که صنعت در برابر بحران منابع داده قرار دارد. همانطور که در تحلیل قبلی ما دربارهی فشارهای اقتصادی مدلهای وزنباز بر آزمایشگاههای پیشرو اشاره کردیم، این پرونده هزینههای پنهان مقیاسبندی مجموعههای آموزشی باکیفیت را برملا میکند. در واقع، مدلهای زبانی بزرگ (LLM) — مثل کتابخانهداری که میلیاردها صفحه را خوانده و حالا با همان لحن کتابها جواب میدهد — برای رسیدن به این سطح از دانش، به حجم عظیمی از داده نیاز دارند که همیشه مسیر دسترسی به آنها قانونی نیست.
قاضی «آراسلی مارتینز-اولگین» روز دوشنبه این توافق را امضا کرد. جزئیات این پرداخت شامل موارد زیر است:
- مبلغ کل: ۱.۵ میلیارد دلار
- سهم هر اثر: ۳,۰۰۰ دلار
- تعداد آثار تحت پوشه: حدود ۵۰۰,۰۰۰ اثر دارای کپیرایت
نکته کلیدی این است که دادگاه، عمل آموزش مدلها بر روی متون دارای کپیرایت را غیرقانونی تشخیص نداد. قاضی «ویلیام الساپ» حکم داد که این فرآیند مصداق «استفاده منصفانه» (Fair Use) است؛ این یک پیروزی فنی بزرگ برای خط لولههای آموزشی صنعت هوش مصنوعی بهشمار میرود.
با این حال، دادگاه بین «آموزش» و «اکتساب» تفاوت قائل شد. آنتروپیک پذیرفت که در کنار کتابهای قانونی، از منابع دزدی مانند لایبراری جنسیس (Library Genesis) و پیرت لایبراری میرور (Pirate Library Mirror) استفاده کرده است. این توافق در واقع راهی است تا شرکت از محاکمه در برابر هیئت منصفه و خسارات احتمالی سنگینتر بگریزد. این فشار مالی در حالی به شرکت وارد میشود که آنتروپیک پیشتر برای تامین زیرساختهای حیاتی خود، توافقی ۱۰ میلیارد دلاری با متا برای اجاره توان محاسباتی منعقد کرده بود تا بتواند رقابت را در سطح مدلهای پیشرفته حفظ کند.
برای شما به عنوان کاربر یا توسعهدهنده، این یعنی چشمانداز فعلی هوش مصنوعی بر روی یک منطقه خاکستری قانونی بنا شده که حالا قیمت آن با میلیاردها دلار محاسبه میشود. چون این تصمیم مربوط به یک دادگاه منطقهای بود و با توافق طرفین پایان یافت، اثر قانونی الزامآوری برای سایر شرکتها نخواهد داشت.
اما اثرات موجگونهای این خبر همین حالا دیده میشود. هفته گذشته، ناشرانی نظیر هاشت (Hachette)، سنجگیج (Cengage) و الزویر (Elsevier) شکایت مشابهی را علیه گوگل برای آموزش جمینای (Gemini) ثبت کردند. غولهای دیگری مثل متا (Meta)، میدجورنی (Midjourney) و اوپنایآی (OpenAI) نیز همچنان درگیر پروندههای مشابهی هستند. این چالشهای داخلی در حالی رخ میدهد که شرکت همزمان در سطح بینالمللی با پیچیدگیهای سیاسی دست و پنجه میزند؛ چنانکه اخیراً توافقی را با دولت ترامپ برای رفع محدودیتهای صادرات مدل Mythos 5 به دست آورد تا بازارهای جهانی را هدف قرار دهد.
گام بعدی شما
- اگر از دادههای وب برای آموزش مدل استفاده میکنید، استراتژی «استفاده منصفانه» را مطالعه کنید تا ریسکهای حقوقی را بشناسید.
- به دنبال مدلهایی باشید که شفافیت بیشتری در مورد منابع دادههای آموزشی خود ارائه میدهند.
- اخبار مربوط به دادگاههای منطقهای دیگر را دنبال کنید تا ببینید آیا منطق «استفاده منصفانه» پذیرفته میشود یا خیر.
این تنها بخشی از هزینهٔ داده است؛ تأثیر این تصمیمها بر قیمت نهایی اشتراکهای ابزارهای هوش مصنوعی را در گزارش بعدی بررسی خواهیم کرد.




گفتگو