सेन्टिनलवन ने फ़ास्ट16 मालवेयर के आधार पर पहला दीर्घ‑होराइज़न रिवर्स‑इंजीनियरिंग बेंचमार्क पेश किया। परीक्षण में केवल GPT‑5.6 Sol ने सभी आठ चरण पूरे किए, जबकि अन्य मॉडलों ने रुकावटें दिखाईं।
मुख्य बिंदु
- फ़ास्ट16 मालवेयर के 8‑स्तरीय परीक्षण में केवल GPT‑5.6 Sol ने सभी चरण पूरे किए
- अन्य प्रमुख एआई मॉडल (GPT‑5.5, GLM‑5.2, Opus 4.x) शुरुआती चरणों में अटक गए
- मानव निगरानी अभी भी एआई‑संचालित सुरक्षा विश्लेषण में अनिवार्य है
फ़ास्ट16 और बेंचमार्क का परिचय
सेन्टिनलवन ने अपने शोध विभाग, सेंटीनेलैब्स, द्वारा दस्तावेज़ित फ़ास्ट16 मालवेयर का उपयोग कर पहला दीर्घ‑होराइज़न रिवर्स‑इंजीनियरिंग बेंचमार्क तैयार किया। यह 2005 का विंडोज़ मालवेयर, LS‑DYNA इंजीनियरिंग सॉफ़्टवेयर को लक्षित करता है, जिसे इरान के परमाणु कार्यक्रम में संभावित रूप से उपयोग किया गया था।
बेंचमार्क पद्धति
बेंचमार्क आठ क्रमिक चरणों में मॉडल की क्षमता को मापता है, जहाँ प्रत्येक चरण में नई साक्ष्य पिछले निष्कर्षों को चुनौती देती है। मॉडल को केवल नई त्रुटियों को ठीक करना नहीं, बल्कि अपने पहले के निष्कर्षों को वापस लेना और पूरी जाँच को पुनः संरेखित करना आवश्यक है।
परिणाम और तुलनात्मक तालिका
| मॉडल | पूरा किए गए चरण | मुख्य टिप्पणी |
|---|---|---|
| GPT‑5.6 Sol | 8/8 | एकल मॉडल ने सभी चरण सफलतापूर्वक पूरे किए |
| GPT‑5.5 | 0/8 | पहले चरण में ही अटका |
| GLM‑5.2 (Z.ai) | 2/8 | स्थानीय विश्लेषण सही, पर आगे नहीं बढ़ा |
| Opus 4.7/4.8 (Anthropic) | 3/8 | कार्य समाप्त घोषित किया, लेकिन दोष अनसुलझे रहे |
Why This Matters
BozokMedia analysis shows that the ability to retract and revise conclusions—what SentinelLabs calls “project‑scale recovery”—is crucial for trustworthy AI‑driven cybersecurity. बिना इस क्षमता के, एआई मॉडल संभावित रूप से गलत या अधूरी रिपोर्ट जारी कर सकते हैं, जिससे संस्थाओं को बड़े जोखिम का सामना करना पड़ सकता है।
“भले ही सबसे उन्नत एआई मॉडल मानव विशेषज्ञता की बराबरी नहीं कर पाते, वे अभी भी जटिल मालवेयर विश्लेषण में एक सहयोगी उपकरण बन सकते हैं।” – डॉ. अली शफ़ी, साइबर सुरक्षा प्रोफेसर
Frequently Asked Questions
Q1: क्या भविष्य में एआई मॉडल सभी आठ चरण स्वयं पूरा कर पाएंगे?
A1: तकनीकी प्रगति के साथ संभावना बढ़ेगी, परंतु मानव निगरानी अभी भी आवश्यक रहेगी।
Q2: इस बेंचमार्क का प्रयोग अन्य प्रकार के साइबर ख़तरों के लिए किया जा सकता है?
A2: हाँ, SentinelOne ने इसे विभिन्न मालवेयर और सॉफ़्टवेयर कमजोरियों के लिए अनुकूलित करने की योजना बनाई है।