پرش به محتوای اصلی
پرش به محتوای مقاله

مایکروسافت: کپی‌لایت در چت‌های Copilot به‌ندرت تکرار می‌شود

·۱۳ شهریور ۱۴۰۵۲ دقیقه مطالعه
مایکروسافت: تقریباً هیچ‌کس مقالات نیویورک‌تایمز را از طریق چت‌بات ما نمی‌خواند
مایکروسافت: تقریباً هیچ‌کس مقالات نیویورک‌تایمز را از طریق چت‌بات ما نمی‌خواند
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

مایکروسافت برای نخستین بار داده‌های واقعی و حجیم از خروجی‌های Copilot را برای اثبات عدم بازتولید متون کپی‌رایت‌شده افشا کرد تا استدلال حقوقی خود را از حالت تئوریک به حالت داده‌محور تبدیل کند.

تصور کنید یک نویسنده یا روزنامه‌نگار متوجه شود که هوش مصنوعی، جملات دقیق مقاله‌اش را بدون اجازه بازنشر می‌کند؛ این کابوسی است که مایکروسافت اکنون سعی دارد آن را با اعداد رد کند. طبق اسنادی که در جمعه، ۴ سپتامبر ۲۰۲۶ ارائه شد، این شرکت مدعی است که چت‌بات Copilot تقریباً هرگز بخش‌های اساسی یا جملات کامل آثار دارای حق چاپ را بازتولید نمی‌کند.

این دفاع در حالی صورت می‌گیرد که مایکروسافت با شکایت‌های ادغامی نیویورک تایمز (New York Times)، انجمن نویسندگان (Authors Guild) و مرکز گزارشگری تحقیقی (CIR) دست‌وپنجه نرم می‌کند. همان‌طور که در تحلیل قبلی ما درباره‌ی تلاش‌های مایکروسافت برای بهینه‌سازی زیرساخت‌ها در پروژه زنیت (Project Zenith) اشاره کردیم، تمرکز این نبرد اکنون بر مرزهای قانونی آموزش مدل‌هاست. مایکروسافت استدلال می‌کند که مدل زبانی بزرگ (LLM) — شبیه کتابخانه‌داری که میلیاردها صفحه را خوانده و حالا با همان لحن کتاب‌ها جواب می‌دهد — مانند دانشجویی است که برای یادگیری یک موضوع هزاران کتاب می‌خواند، بدون آنکه صفحات آن‌ها را عیناً کپی کند.

به نقل از مستندات ارسالی، مایکروسافت برای اثبات ادعای خود، ۸.۲ میلیون تاریخچهٔ چت را در اختیار کارشناسان قرار داد. این داده‌ها نشان‌دهندهٔ نبودِ بازتولید کلمه به کلمه است:

  • تنها ۵۹,۵۴۵ مورد از ۸.۲ میلیون لاگ، حداقل ۱۶ کلمه مشترک با محتوای خبری مورد استفاده برای مبنی‌سازی (Grounding) داشتند.
  • کارشناس مرکز گزارشگری تحقیقی تنها ۵۱ مورد «هم‌پوشانی قابل‌توجه» با آثار آن‌ها یافت.
  • در پرونده نویسندگان، تنها ۲۴ پاسخ حاوی ۳۰ کلمه یا بیشترِ مشابه بود.
  • از ۲۱۲ کتاب ارزیابی‌شده، تنها ۱۰ مورد تطابق داشتند.

بر اساس این گزارش، مایکروسافت استدلال می‌کند که آموزش مدل‌ها «تحول‌آفرین» است. چون سیستم نهایی هدفی متفاوت از گزارشگری یا داستان‌سرایی اصلی دارد، این فرآیند تحت قانون «استفاده منصفانه» قرار می‌گیرد.

این یک قمار بزرگ برای بیزنس هوش مصنوعی است. اگر قاضی حکم به پذیرش این استدلال‌ها بدهد، پرونده به نفع مایکروسافت بسته می‌شود. اما اگر دادگاه تشخیص دهد که حتی بازتولید حداقلی متون، نقض حق چاپ است، کل زنجیره تأمین داده‌های آموزشی و نحوه پرداخت هزینه‌ها باید بازنگری شود.

گام بعدی شما

  • دنبال کردن حکم نهایی قاضی درباره درخواست پذیرش خلاصه پرونده (Summary Judgment).
  • بررسی تأثیر بیانیه اخیر دولت ترامپ در حمایت از OpenAI در پرونده نیویورک تایمز.
  • تحلیل تغییرات در متدهای جمع‌آوری داده برای مدل‌های نسل بعد.

اما تأثیر این نبرد حقوقی بر مدل‌های متن‌باز حتی پیچیده‌تر است — به بررسی ما درباره استانداردهای جدید داده‌های آموزشی مراجعه کنید. این تقابل میان مدل‌های بسته و باز، یادآور تلاش‌های متا برای بازتعریف جایگاه خود در عصر مدل‌های بسته است که در مانیفست اخیر زاکربرگ به تفصیل مورد بحث قرار گرفت.

چرا این موضوع مهم است؟

این پرونده تعیین می‌کند که آیا آموزش مدل‌های هوش مصنوعی یک «استفاده منصفانه» است یا سرقت در مقیاس صنعتی. اعتبار این تصمیم بر اساس تحلیل داده‌های حجیم (۸.۲ میلیون لاگ) بنا شده و می‌تواند سرنوشت اقتصادی تمام شرکت‌های AI را تغییر دهد.

تأثیر برای ایران

این خبر بیشتر برای پژوهشگران مدل‌های بنیادی اهمیت دارد تا بازار مصرف ایران، زیرا نتیجه آن بر هزینه و دسترسی به مدل‌های تجاری آینده اثر می‌گذارد.

·نگاه ما
تحریریه دات‌هوش

تکیه مایکروسافت بر «تعداد دفعات» بازتولید به‌جای «ماهیت» آن، یک استراتژی دفاعی جسورانه است. این رویکرد سعی دارد بحث را از «سرقت مالکیت فکری در مرحله آموزش» به «عدم جایگزینی محصول در مرحله خروجی» تغییر دهد. اگر این منطق پذیرفته شود، مدل‌های زاینده عملاً از پرداخت حق امتیاز برای داده‌های آموزشی رها می‌شوند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.