منوعات

OpenAI تحذف عن طريق الخطأ أدلة محتملة في دعوى حقوق النشر الخاصة بنيويورك تايمز

Published

on

 

ترجمات – وينك

يقول محامو صحيفة نيويورك تايمز وديلي نيوز، اللذان يقاضيان OpenAI بتهمة استخراج أعمالهما لتدريب نماذج الذكاء الاصطناعي الخاصة بها دون إذن، إن مهندسي OpenAI حذفوا عن طريق الخطأ بيانات ذات صلة محتملة بالقضية.

في وقت سابق من هذا الخريف، وافقت OpenAI على توفير جهازين افتراضيين حتى يتمكن محامي صحيفة نيويورك تايمز وديلي نيوز من إجراء عمليات بحث عن المحتوى المحمي بحقوق الطبع والنشر في مجموعات تدريب الذكاء الاصطناعي الخاصة بها. (الأجهزة الافتراضية هي أجهزة كمبيوتر تعتمد على البرامج وتوجد داخل نظام تشغيل كمبيوتر آخر، وغالبًا ما تستخدم لأغراض الاختبار والنسخ الاحتياطي للبيانات وتشغيل التطبيقات.) في رسالة، يقول محامو الناشرين إنهم والخبراء الذين استأجروهم قضوا أكثر من 150 ساعة منذ الأول من نوفمبر في البحث في بيانات تدريب OpenAI.

ولكن في الرابع عشر من نوفمبر/تشرين الثاني، قام مهندسو شركة OpenAI بمسح جميع بيانات البحث الخاصة بالناشرين المخزنة على أحد الآلات الافتراضية، وفقًا للرسالة المذكورة أعلاه، والتي تم تقديمها إلى المحكمة الجزئية الأمريكية للمنطقة الجنوبية من نيويورك في وقت متأخر من يوم الأربعاء.

حاولت شركة OpenAI استعادة البيانات – وكانت ناجحة في الغالب. ومع ذلك، نظرًا لأن بنية المجلد وأسماء الملفات ضاعت “بشكل لا يمكن استرجاعه”، فإن البيانات المستردة “لا يمكن استخدامها لتحديد المكان الذي تم فيه استخدام المقالات المنسوخة للمدعين الإخباريين لبناء نماذج [OpenAI]”، وفقًا للرسالة.

كتب محامي صحيفة The Times and Daily News: “لقد أُجبر المدعون الإخباريون على إعادة إنشاء عملهم من الصفر باستخدام ساعات عمل كبيرة ووقت معالجة الكمبيوتر”. “علم المدعون الإخباريون بالأمس فقط أن البيانات المستردة غير قابلة للاستخدام وأن أسبوعًا كاملاً من عمل الخبراء والمحامين يجب إعادة إنجازه، ولهذا السبب يتم تقديم هذه الرسالة التكميلية اليوم”.

ويوضح محامي المدعين أنه ليس لديهم سبب للاعتقاد بأن الحذف كان متعمدًا. لكنهم يقولون إن الحادث يؤكد أن OpenAI “في أفضل وضع للبحث في مجموعات البيانات الخاصة بها” عن المحتوى الذي قد ينتهك حقوق الملكية الفكرية باستخدام أدواتها الخاصة.

ورفض متحدث باسم OpenAI الإدلاء ببيان في هذه القضية وغيرها، أكدت OpenAI أن نماذج التدريب باستخدام البيانات المتاحة للجمهور – بما في ذلك المقالات من The Times وDaily News – هي استخدام عادل. بعبارة أخرى، في إنشاء نماذج مثل GPT-4o، والتي “تتعلم” من مليارات الأمثلة من الكتب الإلكترونية والمقالات والمزيد لتوليد نص يبدو بشريًا، تعتقد OpenAI أنها ليست ملزمة بترخيص الأمثلة أو دفع ثمنها بطريقة أخرى – حتى لو كانت تجني المال من هذه النماذج.

ومع ذلك، أبرمت شركة OpenAI صفقات ترخيص مع عدد متزايد من الناشرين الجدد، بما في ذلك وكالة أسوشيتد برس، ومالك موقع Business Insider، أكسل سبرينغر، وصحيفة فاينانشال تايمز، والشركة الأم لمجلة People، دوت داش ميريديث، ونيوز كورب. ورفضت شركة OpenAI الكشف عن شروط هذه الصفقات، ولكن ورد أن أحد شركاء المحتوى، دوت داش، يتقاضى 16 مليون دولار على الأقل سنويًا.

ولم تؤكد شركة OpenAI أو تنفي أنها دربت أنظمة الذكاء الاصطناعي الخاصة بها على أي أعمال محمية بحقوق الطبع والنشر دون إذن.

 

Click to comment

محتوى رائج

جميع الحقوق محفوظة لموقع وينك © 2019.