Microsoft-ன் முதல் சைபர் பாதுகாப்பு AI மாதிரி MAI-சைபர்-1-ஃப்ளாஷ், Google, OpenAI மற்றும் Anthropic ஆகியோரின் மாடல்களை விட அதிகமான பிழை கண்டறிதல் முடிவுகளை காட்டியுள்ளது. CyberGym மதிப்பீட்டு சூழலில் இது முன்னணி இடத்தை பெற்றுள்ளது.
MAI-சைபர்-1-ஃப்ளாஷ் சிக்கலான குறியீட்டில் உள்ள கடினமான பலவீனங்களை கண்டறிய வடிவமைக்கப்பட்டு, Microsoft-ன் MDASH பல-நுண்ணறிவு முகவர் அமைப்பில் ஒருங்கிணைக்கப்பட்டுள்ளது. MDASH-இல் 100-க்கும் மேற்பட்ட சிறப்பு AI முகவர்கள் செயல்பட்டு, நிறுவனத்தின் சொந்த குறியீட்டில் பல பலவீனங்களை கண்டறிந்துள்ளன.
CyberGym பாதுகாப்பு மதிப்பீட்டு கட்டமைப்பில் செய்யப்பட்ட சோதனையில், MAI-சைபர்-1-ஃப்ளாஷ் (MDASH மற்றும் GPT-5.4 உடன்) Google-ன் 3.5 Flash Cyber, OpenAI-ன் GPT-5.6 Sol, Anthropic-ன் Mythos 5 ஆகியவற்றை ஒப்பிடும்போது முன்னிலை பெற்றது. Microsoft கூறியது, இந்த கூட்டணி 50% செலவு சேமிப்பை வழங்கி, கடினமான 10% பணிகளை உயர்ந்த மாடல்களைப் பயன்படுத்தி திறமையாக நிர்வகிக்கிறது.