एआई दिग्गज एंथ्रोपिक ने अपने नवीनतम मॉडलों में सुरक्षा उपायों को मजबूत किया है ताकि हथियारों के निर्माण और राज्य-प्रायोजित दुष्प्रचार को रोका जा सके।
- एंथ्रोपिक ने स्पाइवेयर विक्रेताओं और राज्य-प्रायोजित समूहों द्वारा दुरुपयोग को रोका।
- हथियारों के विकास में सहायता रोकने के लिए नए सुरक्षा उपाय लागू किए गए।
- सुरक्षा खामियों के संबंध में आंतरिक व्हिसलब्लोअर्स ने चेतावनी दी थी।
आर्टिफिशियल इंटेलिजेंस सुरक्षा को मजबूत करने की दिशा में एक महत्वपूर्ण कदम उठाते हुए, एंथ्रोपिक (Anthropic) ने खुलासा किया है कि उसने अपने उन्नत एआई मॉडलों के दुरुपयोग के कई प्रयासों को सफलतापूर्वक विफल कर दिया है। यह कार्रवाई उन व्हिसलब्लोअर्स की गंभीर चेतावनियों के बाद की गई है, जिन्होंने उन कमजोरियों की ओर इशारा किया था जिनका उपयोग खतरनाक सामग्री बनाने या दुष्प्रचार अभियानों के लिए किया जा सकता था।
आंतरिक डेटा से पता चलता है कि दिसंबर 2025 और अगस्त 2026 के बीच, कंपनी के शोधकर्ताओं ने विभिन्न प्रकार के दुर्भावनापूर्ण तत्वों की पहचान की। इनमें स्पाइवेयर विक्रेता, राजनीतिक रूप से प्रेरित व्यक्ति और परिष्कृत राज्य-प्रायोजित समूह शामिल थे। इन समूहों का मुख्य उद्देश्य एआई की क्षमताओं का उपयोग दुष्प्रचार फैलाने और प्रतिबंधित तकनीकों को विकसित करने के लिए करना था।
यह क्यों महत्वपूर्ण है
BozokMedia के विश्लेषण से पता चलता है कि जैसे-जैसे लार्ज लैंग्वेज मॉडल्स (LLMs) अधिक सक्षम हो रहे हैं, 'दोहरे उपयोग' (dual-use) की समस्या एक प्रणालीगत जोखिम बन गई है। हथियारों से संबंधित प्रश्नों को ब्लॉक करके एंथ्रोपिक ने उद्योग के लिए एक मिसाल कायम की है, जिससे ध्यान केवल खामियों को सुधारने के बजाय सक्रिय सुरक्षा संरेखण (proactive safety alignment) पर केंद्रित हुआ है।
एआई क्षमता और राज्य-प्रायोजित दुर्भावना का मिलन 21वीं सदी की सबसे महत्वपूर्ण सुरक्षा चुनौती है।
कंपनी ने अब अपने नवीनतम मॉडलों को मजबूत सुरक्षा उपायों के साथ अपडेट किया है। ये प्रतिबंध विशेष रूप से उन अनुरोधों का पता लगाने और उन्हें बेअसर करने के लिए डिज़ाइन किए गए हैं जो जैविक हथियारों के संश्लेषण या रासायनिक एजेंटों के निर्माण की ओर ले जा सकते हैं, जिससे यह सुनिश्चित हो सके कि एआई आतंकवाद या युद्ध के लिए एक उपकरण न बने।
ऐतिहासिक रूप से, एआई उद्योग 'जेलब्रेकिंग' से जूझता रहा है, जहां उपयोगकर्ता सुरक्षा फिल्टर को बायपास करने के रचनात्मक तरीके खोजते हैं। एंथ्रोपिक के हालिया अपडेट 'कॉन्स्टिट्यूशनल एआई' की ओर एक कदम हैं, जहां मॉडल के मूल तर्क को इस तरह प्रशिक्षित किया जाता है कि वह किसी भी तरह के हानिकारक अनुरोध को अस्वीकार कर दे।
अक्सर पूछे जाने वाले प्रश्न
प्रश्न 1: एंथ्रोपिक के एआई का दुरुपयोग करने की कोशिश करने वाले मुख्य तत्व कौन थे?
उत्तर 1: इनमें स्पाइवेयर विक्रेता, राजनीतिक रूप से प्रेरित व्यक्ति और दुष्प्रचार फैलाने वाले राज्य-प्रायोजित समूह शामिल थे।
प्रश्न 2: व्हिसलब्लोअर ने किन विशिष्ट जोखिमों के बारे में चेतावनी दी थी?
उत्तर 2: चेतावनियाँ मुख्य रूप से हथियारों के निर्माण में एआई की संभावित सहायता और राज्य-नेतृत्व वाले दुष्प्रचार के प्रसार पर केंद्रित थीं।