افشای اسناد جدید مایکروسافت و OpenAI درباره سرقت محتوای وب

اسناد جدید پرونده نیویورک تایمز نشان می‌دهد مدیران مایکروسافت و OpenAI به خطرات و ابعاد گسترده استفاده از محتوای ناشران برای هوش مصنوعی آگاه بوده‌اند.

تتیم تحریریه۴ دقیقه مطالعه۰ بازدید۱۷ ساعت پیش
افشای اسناد جدید مایکروسافت و OpenAI درباره سرقت محتوای وب

نشریه نیویورک تایمز (The New York Times) در اواخر سال ۲۰۲۳ از شرکت‌های OpenAI و مایکروسافت (Microsoft) به دلیل نقض حق چاپ شکایت کرد و این پرونده ظاهراً پس از گذشت حدود سه سال همچنان در جریان است. اکنون تیم حقوقی این نشریه پس از ارائه یک لایحه حقوقی افشاگرانه بر اساس بیانیه‌ها و اسناد متهمان، از دادگاه درخواست صدور رأی اجمالی کرده است. بر اساس گزارش فور اوفور مدیا (404 Media)، این اسناد به درخواست هر دو شرکت همچنان مهروموم یا ویرایش شده باقی مانده‌اند، اما افشاگری‌ها نشان‌دهنده بیانیه‌های بالقوه مخربی از سوی رهبران آن‌هاست؛ از جمله ادعاهایی مبنی بر اینکه جمع‌آوری داده توسط هوش مصنوعی بزرگ‌ترین سرقت نیروی کار در تاریخ بشر و یک تهدید وجودی برای ناشران است.

این لایحه به یک یادداشت داخلی متعلق به ژانویه ۲۰۲۳ توسط برنت هکت (Brent Hecht)، مدیر علوم کاربردی مایکروسافت (Microsoft) استناد کرد که در آن ادعا شده است: «میلیون‌ها نفر در سراسر جهان به‌زودی جذب و مکیده شدن تمام کارهایشان توسط مدل‌های بزرگ را سرقتی خیره‌کننده در ابعادی بی‌سابقه خواهند دانست» و همچنین آن را «بزرگ‌ترین سرقت نیروی کار در تاریخ بشر» نامیده است. سند دیگری از مایکروسافت (Microsoft) نیز ذکر شده که می‌گوید: «تقریباً هیچ‌کس قصد نداشت محتوایی که خلق کرده است به این شکل مورد استفاده قرار گیرد و هیچ غرامتی نیز برای استفاده از آن دریافت نمی‌کنند.»

با افزایش محبوبیت چت‌جی‌پی‌تی (ChatGPT) در طول سال ۲۰۲۳، داده‌های خود این غول نرم‌افزاری نشان داد که کوپلوت (Copilot) نرخ کلیک برای نیویورک تایمز (The New York Times) را در مقایسه با جستجوی بینگ (Bing) تا ۹۳ درصد کاهش داده است. یادداشت دیگری توسط مدیر علوم کاربردی، آن را یک «چرخه عذاب» نامید و گفت که این امر «در همان زمان به عملکرد مدل‌های ما و کل وب آسیب می‌رساند.» لایحه نیویورک تایمز (The New York Times) به نقل از هکت (Hecht) در این سند می‌گوید: «بسیار غیرعادی است که یک محصول نهایی، بنیان‌های اقتصادی تأمین‌کنندگان ضروری خود را تهدید کند، اما این وضعیتی است که ما برای کسب‌وکار مدل زبانی بزرگ (LLM) خود در رابطه با «زنجیره تأمین محتوا» آن ایجاد کرده‌ایم.»

نیک تورلی (Nick Turley)، رئیس بخش چت‌جی‌پی‌تی (ChatGPT) در OpenAI در ارتباطات داخلی گفت که این ربات گفتگوگر هوش مصنوعی یک «تهدید وجودی» برای ناشران است، زیرا آن‌ها «تا حد زیادی جایگزین‌شونده» هستند و «با بهتر شدن، جایگزین‌شونده‌تر نیز خواهند شد»، در حالی که یک مهندس دیگر از OpenAI شهادت داد که «هرچقدر هم که لینک‌ها را برجسته نمایش دهیم، کاربران کلیک نخواهند کرد.» نیک رایدر (Nick Ryder)، محقق دیگر OpenAI، به گرگ براکمن (Greg Brockman)، رئیس شرکت، درباره یک «ترفند برای دور زدن دیوار پرداخت نیویورک تایمز» گفت که او در پاسخ گفت: «آه، خوبه.»

شرکت‌های هوش مصنوعی استدلال می‌کنند که جمع‌آوری داده از اینترنت برای تغذیه مدل‌هایشان «استفاده منصفانه (fair use)» است، و یک دادگاه موافقت کرد که استفاده آنتروپیک (Anthropic) از مطالب منتشر شده در این دسته قرار می‌گیرد. این قانون آن را به عنوان «انتقاد، تفسیر، گزارش خبری، آموزش (از جمله کپی‌های متعدد برای استفاده در کلاس درس)، بورس تحصیلی یا پژوهش» تعریف می‌کند. برخی از عواملی که تعیین می‌کنند آیا یک استفاده خاص تحت عنوان «استفاده منصفانه» قرار می‌گیرد یا خیر عبارتند از: «(۱) هدف و ماهیت استفاده، از جمله اینکه آیا چنین استفاده‌ای جنبه تجاری دارد یا برای اهداف آموزشی غیرانتفاعی است؛ (۲) ماهیت اثر دارای حق چاپ؛ (۳) مقدار و اهمیت بخش استفاده شده در رابطه با اثر دارای حق چاپ به عنوان یک کل؛ و (۴) تأثیر استفاده بر بازار بالقوه یا ارزش اثر دارای حق چاپ.»

با این حال، تمام این افشاگری‌ها در لایحه نیویورک تایمز (The New York Times) می‌تواند دفاعیه استفاده منصفانه OpenAI را پیچیده کند، به‌ویژه که نشان می‌دهد رهبری هر دو شرکت از پیامدهای احتمالی بازار ناشی از جمع‌آوری داده‌های هوش مصنوعی آگاه هستند. ساتیا نادلا (Satya Nadella)، مدیرعامل مایکروسافت (Microsoft)، در شهادتی در اوایل سال جاری گفت که «هر چیزی که پشت دیوار پرداخت است باید توسط هرکسی که می‌خواهد از آن استفاده کند... برای پایه‌گذاری یا آموزش، مجوز دریافت کند» و اگر او «مطلع می‌شد که OpenAI اطلاعات پشت دیوار پرداخت را جمع‌آوری کرده و بر روی آن‌ها آموزش دیده است»، این شرکت OpenAI را ملزم می‌کرد که «مدل‌های خود را دوباره آموزش دهد.»


منبع: tomshardware.com

نظرات۰

برای نوشتن نظر، وارد حساب خود شوید.

ورود / ثبت‌نام

هنوز نظری ثبت نشده — اولین نفری باش که نظر می‌دهد.