अमेरिकी खुफिया एजेंसियों ने खुलासा किया है कि चीनी एआई फर्मों ने OpenAI, Google और Anthropic जैसे अग्रणी मॉडल्स से अरबों टोकन चोरी किए हैं। इस 'इंडस्ट्रियल-स्केल' डिस्टिलेशन के जरिए चीन अपनी एआई विकास लागत को कम करने की कोशिश कर रहा है।
- चीनी कंपनियां 'डिस्टिलेशन' तकनीक का उपयोग कर अमेरिकी एआई मॉडल्स की क्षमताओं को चुरा रही हैं।
- Alibaba, DeepSeek और Moonshot AI जैसी कंपनियों पर OpenAI, Google Gemini और Grok के डेटा के अवैध उपयोग का आरोप है।
- FBI, NSA और CISA ने चेतावनी दी है कि यह अभियान चीनी सरकार की जानकारी में चलाया जा रहा है।
अमेरिकी सरकार की प्रमुख सुरक्षा एजेंसियों—FBI, NSA और CISA—ने एक संयुक्त परामर्श जारी कर दुनिया को आगाह किया है कि चीन की एआई कंपनियां अमेरिकी फ्रंटियर मॉडल्स की बौद्धिक संपदा को बड़े पैमाने पर चुरा रही हैं। इन कंपनियों ने कथित तौर पर 2024 के अंत से Claude, GPT, Gemini और Grok जैसे मॉडल्स से अरबों टोकन निकाले हैं ताकि वे अपने स्वयं के मॉडल्स को कम लागत में विकसित कर सकें।
इस प्रक्रिया को 'डिस्टिलेशन' (Distillation) कहा जाता है। तकनीकी रूप से, यह एक ऐसी विधि है जहाँ एक परिपक्व 'शिक्षक' (Teacher) मॉडल का उपयोग एक छोटे 'छात्र' (Student) मॉडल को प्रशिक्षित करने के लिए किया जाता है। हालांकि शैक्षणिक शोध में यह मान्य है, लेकिन अमेरिकी एजेंसियों का दावा है कि चीनी फर्मों ने इसे चोरी के उपकरण के रूप में इस्तेमाल किया है, जो सेवा की शर्तों (Terms of Service) का सीधा उल्लंघन है।
Why This Matters
BozokMedia विश्लेषण से पता चलता है कि यह केवल एक तकनीकी विवाद नहीं बल्कि एक गहरा भू-राजनीतिक संघर्ष है। यदि चीन अमेरिकी एआई की तर्क क्षमता (Reasoning Capabilities) को बिना भारी निवेश के हासिल कर लेता है, तो यह वैश्विक एआई प्रभुत्व के संतुलन को बिगाड़ सकता है। यह 'शॉर्टकट' चीन को अरबों डॉलर की शोध लागत बचाने और विकास की समयसीमा को कम करने में मदद कर रहा है।
मॉडल निष्कर्षण और डिस्टिलेशन को अब केवल API दुरुपयोग नहीं, बल्कि एक गंभीर सुरक्षा घटना (Security Event) के रूप में देखा जाना चाहिए।
रिपोर्ट के अनुसार, DeepSeek जैसी कंपनियों ने अपने प्रशिक्षण खर्च को 5.6 मिलियन डॉलर बताया है, लेकिन अमेरिकी एजेंसियों का दावा है कि यह आंकड़ा भ्रामक है क्योंकि इसमें चोरी किए गए डेटा की वास्तविक लागत शामिल नहीं है। वहीं, Moonshot AI ने कथित तौर पर अपने Kimi-K3 मॉडल को प्रशिक्षित करने के लिए Claude Fable 5 के डेटा का उपयोग किया है।
इन चोरी की गतिविधियों को छिपाने के लिए, चीनी फर्मों ने प्रीमियम सब्सक्रिप्शन साझा करने, क्लाउड प्रदाताओं के माध्यम से अनुरोधों को रूट करने और भौगोलिक प्रतिबंधों को दरकिनार करने के लिए 'ट्रांसफर स्टेशनों' (प्रॉक्सी) का उपयोग किया है।
| कंपनी (आरोपी) | लक्षित अमेरिकी मॉडल | उद्देश्य |
|---|---|---|
| DeepSeek | Frontier Models (General) | सिंथेटिक ट्रेनिंग डेटा उत्पन्न करना |
| Moonshot AI | Claude Fable 5, GPT-4o | Kimi-K2 और Kimi-K3 का प्रशिक्षण |
| Alibaba/Z.AI | Gemini, Grok, GPT | विकास लागत और समय में कमी |
Frequently Asked Questions
1. एआई डिस्टिलेशन क्या है?
यह एक प्रक्रिया है जिसमें एक बड़े और शक्तिशाली एआई मॉडल के आउटपुट का उपयोग एक छोटे मॉडल को प्रशिक्षित करने के लिए किया जाता है ताकि वह अधिक कुशल बन सके।
2. अमेरिकी एजेंसियां किन कंपनियों पर आरोप लगा रही हैं?
मुख्य रूप से Alibaba, DeepSeek, MiniMax, Moonshot AI, StepFun और Z.AI जैसी चीनी फर्मों पर आरोप लगाए गए हैं।