السياسات والتنظيم
The New York Times تتهم OpenAI بإخفاء أدلة في دعوى حقوق النشر الخاصة بـ ChatGPT
اتهمت صحيفتا The New York Times وThe Daily News شركة OpenAI بإخفاء أدلة وحذف مليارات من مخرجات ChatGPT في دعوى حقوق النشر الجارية بينهما.
طلبت صحيفتا The New York Times وThe Daily News من قاضٍ فدرالي اتخاذ إجراءات تأديبية بحق OpenAI، بدعوى أن الشركة تكذب بشأن قدرتها على البحث في بيانات سجلات دردشة العملاء ومجموعات بيانات التدريب عن أعمالهما المحمية بحقوق النشر. ويُعد هذا أحدث تصعيد في دعوى قضائية مستمرة منذ عامين تتهم OpenAI بانتهاك قانون حقوق النشر من خلال تدريب نماذج الذكاء الاصطناعي التوليدي الخاصة بها على محتوى صحيفة The New York Times وإعادة إنتاج تلك المواد الصحفية في مخرجات المستخدمين. كما يدّعي المدعون أن OpenAI حذفت مليارات من مخرجات ChatGPT بعد رفع الدعوى في انتهاك مباشر لأمر الحفظ الصادر عن المحكمة، واستبدلت ملايين السجلات في العينة المطلوبة؛ وهو سلوك يقولون إنه يرقى إلى حجب الأدلة والعبث بعملية الكشف عن الأدلة (مرحلة ما قبل المحاكمة التي يتبادل فيها الأطراف الأدلة). وجادل Ian B. Crosby، المحامي الرئيسي للمدعين، بأنه لو كانت OpenAI تعتقد بصدق أن استخدامها للمواد الصحفية الخاصة بالوسائل الإعلامية كان عادلاً وقانونياً، لما كانت لتخفي قيامها بذلك.
وبحسب الادعاءات، كشفت شهادة أدلى بها Vinnie Monaco، مهندس خصوصية البيانات في OpenAI، في شهر أبريل بموجب أمر قضائي، أن OpenAI قد أجرت بالفعل عمليات بحث وتقييمات داخلية لمجموعة بيانات التدريب الخاصة بها للبحث عن الأعمال الصحفية المحمية بحقوق النشر. كما يُدعى أن شهادة Vinnie Monaco أظهرت أنه حتى قبل رفع الدعوى القضائية، كانت OpenAI قد جمعت قاعدة بيانات تضم نحو 78 مليون محادثة ChatGPT مجهولة الهوية، واستخدمتها داخلياً لتقدير مدى انتهاكها لأعمال الآخرين.
وعلاوة على ذلك، يُدعى أن شهادة Vinnie Monaco كشفت أن OpenAI طبقت مرشح Bloom (وهو بنية بيانات تُستخدم للكشف عن النصوص المتطابقة) كجزء من مجموعة أدوات داخلية تُسمى Project Giraffe، والتي رصدت وسجلت عملية الاجترار (regurgitation) — وهي إعادة إنتاج نصوص التدريب في المخرجات — بعد فترة وجيزة من رفع الدعوى القضائية. ويقول المدعون إن هذا يضعف حجة OpenAI بأن البحث في سجلاتها كان عبئاً تقنياً كبيراً، لا سيما وأن OpenAI تفاوضت لتقليص عينة مطلوبة قوامها 120 مليون سجل دردشة إلى 20 مليون سجل فقط، والتي قدمتها إلى المحاكم في ديسمبر الماضي، والتي يقول المدعون إنها تضمنت ملايين السجلات المستبدلة.
ونفى Drew Pusateri، المتحدث باسم OpenAI، هذه الادعاءات. وقال Drew Pusateri: “مع ضعف قضية The New York Times واضطرارهم لإسقاط ادعاءات ضدنا، فإنهم يواصلون جهودهم لانتهاك خصوصية أشخاص ليس لهم أي علاقة بهذه القضية، بما في ذلك من خلال توجيه هذه الادعاءات الكاذبة تماماً”. وأضاف أن OpenAI ستواصل الدفاع عن خصوصية مستخدميها ومبادئ الاستخدام العادل الراسخة منذ زمن طويل.
لماذا يهم
يسلط هذا النزاع الضوء على الاحتكاك القانوني المتزايد بشأن شفافية تدريب الذكاء الاصطناعي، حيث يحاول الناشرون إثبات انتهاك حقوق النشر بينما يحمي مطورو الذكاء الاصطناعي بيانات التدريب وخصوصية المستخدمين.