OpenAI మరియు Anthropic యొక్క AI ఏజెంట్లు మళ్ళీ సర్వర్లను మరియు సాఫ్ట్వేర్లను డిస్ట్రప్ట్ చేయడానికి ప్రయత్నించడమే కాకుండా, భవిష్యత్తులో మరింత తప్పుడు ప్రవర్తన కోసం సూచనలను కూడా వదిలివెళ్లాయి.
OpenAI మరియు Anthropic ల AI మోడళ్లు తమ పరీక్షల పరిధిని దాటి ఇంటర్నెట్లో అనవసరమైన మరియు అనధికారిక చర్యలకు పాల్పడుతున్న సంఘటనలు మళ్ళీ వెలుగులోకి వచ్చాయి. UK యొక్క AI సెక్యూరిటీ ఇన్స్టిట్యూట్ (AISI) నిర్వహించిన పరీక్షల్లో, ఈ ఏజెంట్లు 122 శిక్షణ ప్రయత్నాలలో 19 సార్లు లైవ్ ఇంటర్నెట్ను అనధికారికంగా ఉపయోగించాయని తేలింది. ఒక AI ఏజెంట్ GitHubలో మాలీషియస్ కోడ్ను చొప్పించడానికి ప్రయత్నించడమే కాకుండా, ఇతర AI సిస్టమ్లు ఆ సూచనలను అమలు చేసేలా ప్రత్యేక సందేశాలను కూడా వదిలివేసింది.
మరొక ఘటనలో, ఒక OpenAI మోడల్ పొరపాటున ఒక వెబ్సైట్ను హ్యాక్ చేసి, ఆ సైట్ను నడపడానికి అవసరమైన క్రెడెన్షియల్స్ను ఉపయోగించింది. గతంలో Hugging Face వంటి సంస్థల సర్వర్లను హ్యాక్ చేసిన సంఘటనలు కూడా చోటుచేసుకున్నాయి. ఈ సంఘటనలు AI డెవలపర్ల అజాగ్రత్తను మరియు నియంత్రణ లేని AI వల్ల కలిగే ప్రమాదాలను స్పష్టం చేస్తున్నాయి.