در دسامبر 2023، روزنامه نیویورک تایز (The New York Times) یکی از بزرگترین پروندههای حقوقی مربوط به کپیرایت را در تاریخ اخیر علیه شرکتهای اوپنایآی (OpenAI) و مایکروسافت (Microsoft) ثبت کرد و مدعی شد که مدلهای هوش مصنوعی این شرکتها حجم نجومی از آثار روزنامهنگاری این روزنامه را سرقت کردهاند. دو روز پیش، یک پرونده دادگاه که توسط وبسایت آرس تکنيکا (Ars Technica) میزبانی و تحلیل شده بود، با انواع نقلقولهای افشاگرانه از ردهبالاهای مایکروسافت و اوپنایآی از حالت محرمانگی خارج شد.
شاید تکاندهندهترین نظرات متعلق به مدیر علوم کاربردی مایکروسافت، برنت هکت (Brent Hecht) باشد که در یک ارائه داخلی نوشت موتور پاسخگویی کوپایلوت (Copilot) «به طور همزمان به عملکرد مدلهای ما و کل وب آسیب میرساند.»
دادههای داخلی مایکروسافت نشان میدهد که این موتور باعث کاهش نرخ کلیک نتایج جستجوی نیویورک تایز بین 87 تا 93 درصد در مقایسه با جستجوهای استاندارد بینگ (Bing) شده است. برای دامنههای شرکت زیف دیویس (Ziff Davis) - شرکتی که مالک یوروگیمر (Eurogamer) و آیجیان (IGN) است - نرخ کلیک بین 51 تا 94 درصد کاهش یافته است.
هکت این پویایی را که در آن هوش مصنوعی آثار مکتوب را به خاطر ارزش اقتصادیشان اسکرپ کرده و سپس آنها را در پاسخهای به راحتی قابل دسترس هوش مصنوعی قرار میدهد، یک «حلقه عذاب... بسیار غیرعادی است که یک محصول نهایی تهدیدی برای مبانی اقتصادی تأمینکنندگان اصلی خود باشد، اما این وضعیتی است که ما برای کسبوکار مدلهای زبانی بزرگ (LLM) خود در رابطه با زنجیره تامین محتوای آن ایجاد کردهایم.»
این پرونده همچنین نشان میدهد که وقتی یک محقق برای اوپنایآی، نیک رایدر (Nick Ryder)، به رئیس اوپنایآی گرگ براکمن (Greg Brockman) درباره «یک هک برای دور زدن دیوار پرداخت نیویورک تایز» جهت کمک به اسکرپ کردن نوشتههای آن گفت، براکمن پاسخ داد «آه عالی». اسناد داخلی اوپنایآی نشان میدهد که براکمن مینویسد مدلهای زبانی بزرگ (LLMs) در «هر کار خبری بسیار خوب هستند.»
در یادداشتی در ژانویه 2023، هکت این موضوع را «بزرگترین سرقت کار در تاریخ بشر» نامید. دفاع معمولی برای همه این موارد، که پرونده به طور گستردهای آن را رد میکند، این است که باید مشمول استفاده منصفانه (Fair Use) قرار گیرد. به ویژه، مدیرعامل مایکروسافت، ساتیا نادلا (Satya Nadella)، اوایل امسال در یک شهادتنامه زیر سوگند گفت که اگر میدانست اوپنایآی از اطلاعات دارای دیوار پرداخت برای آموزش مدلهای زبانی بزرگ استفاده میکند، «[اوپنایآی را ملزم میکرد] مدلهای خود را دوباره آموزش دهد.»
منبع: pcgamer.com
