न्यूयॉर्क टाइम्स और द डेली न्यूज़ ने आरोप लगाया कि OpenAI ने अपने प्रशिक्षण डेटाबेस और चैट लॉग में मौजूद कॉपीराइटेड सामग्री को छुपाया, जिससे मुकदमे में नई सजा की मांग की गई है।

न्यूयॉर्क टाइम्स और द डेली न्यूज़ ने संयुक्त रूप से दायर किए गए मुकदमे में OpenAI पर गंभीर आरोप लगाया है। उनका दावा है कि कंपनी ने अपने बड़े पैमाने के प्रशिक्षण कोरपस और लगभग 78 मिलियन डि‑आईडेंटिफाइड चैटजीपीटी वार्तालापों की डेटाबेस को छुपाकर, कॉपीराइटेड पत्रकारिता सामग्री को पहचानने से बचा है। यह आरोप दो‑साल पुरानी कानूनी लड़ाई में नई तीव्रता लाता है, जहाँ OpenAI पर अपने जनरेटिव एआई मॉडल को न्यूयॉर्क टाइम्स की सामग्री पर प्रशिक्षित करने और उपयोगकर्ता आउटपुट में वही सामग्री दोहराने का आरोप है।

विरोधी पक्ष की मांगें और OpenAI का बचाव

मुकदमे में, प्रकाशकों ने OpenAI से यह साबित करने की मांग की है कि उनके कॉपीराइटेड लेख प्रशिक्षण डेटाबेस में मौजूद हैं या नहीं, और यह भी कि ChatGPT ने कितनी बार इन लेखों को पुनः उत्पन्न किया। OpenAI ने निरंतर कहा है कि वह अपने प्रशिक्षण कॉर्पस को खोजने की तकनीकी क्षमता नहीं रखता, और उपयोगकर्ता गोपनीयता को लेकर भी चिंतित है, क्योंकि लॉग को पुनः पहचानना, प्रक्रिया करना और डि‑आईडेंटिफाइ करना कठिन है।

अप्रकाशित साक्ष्य और “Project Giraffe” का खुलासा

अप्रैल में अदालत‑आदेशित डिपोज़िशन में OpenAI के डेटा प्राइवेसी इंजीनियर विनि मोनाको ने स्वीकार किया कि कंपनी ने पहले ही अपने कोरपस में कॉपीराइटेड पत्रकारिता की खोज की थी। मोनाको ने बताया कि मुकदमा दायर होने से पहले ही कंपनी ने लगभग 78 मिलियन डि‑आईडेंटिफाइड चैटजीपीटी वार्तालापों का डेटाबेस तैयार किया था, जिससे यह पता लगाया जा सके कि वह कितनी बार अन्य के काम का उल्लंघन कर रही है। इसके अतिरिक्त, “Project Giraffe” नामक एक उपकरण समूह में “Bloom” फ़िल्टर लागू किया गया, जो आउटपुट में पुनरावृत्ति को पहचानता और रिकॉर्ड करता है।

अदालत में प्रस्तुत साक्ष्य की विश्वसनीयता पर सवाल

प्रकाशकों ने मूल रूप से 120 मिलियन चैट लॉग का नमूना माँगा था, लेकिन OpenAI ने इसे घटाकर 20 मिलियन किया। दिसंबर में पेश किया गया नमूना अत्यधिक रिडैक्शन के कारण अदालत ने इसे “अप्रयोगी” कहा। इसके अलावा, OpenAI पर यह भी आरोप है कि उसने मुकदमा दायर होने के बाद अरबों ChatGPT आउटपुट को हटा दिया, जिससे अदालत के संरक्षण आदेश का उल्लंघन हुआ, और माँगे गए नमूने में कई लॉग को बदल दिया गया। इस प्रकार, न्यूयॉर्क टाइम्स और द डेली न्यूज़ ने न्यायाधीश से OpenAI के खिलाफ सज़ा, साक्ष्य को अस्वीकार करने और कानूनी शुल्क वसूलने की मांग की है।

OpenAI का उत्तर और भविष्य की दिशा

OpenAI के प्रवक्ता ड्रू पुसातेरी ने इन आरोपों को अस्वीकार करते हुए कहा कि टाइम्स अपने केस को कमजोर करने के बाद भी निजी उपयोगकर्ता वार्तालापों तक पहुँचने की कोशिश कर रहा है। पुसातेरी ने कहा, “हम अपने उपयोगकर्ताओं की गोपनीयता और फेयर युज़ के सिद्धांतों की रक्षा जारी रखेंगे।” यह विवाद एआई कंपनियों के डेटा उपयोग, कॉपीराइट और उपयोगकर्ता गोपनीयता के बीच जटिल संतुलन को उजागर करता है, और भविष्य में नियामक ढांचे को कैसे आकार देगा, इस पर गहरा प्रभाव डाल सकता है।