సైబర్ సెక్యూరిటీ పరిశోధకులు, OpenAI మరియు Anthropic అందించే గార్డ్రైళ్స్, తెలియని బలహీనతలను కనుగొనడం, వాటిని వినియోగించడానికి టూల్స్ అభివృద్ధి చేయడంలో అడ్డుకావుతున్నాయని చెప్పారు. ఈ పరిమితులు చట్టబద్ధ రక్షకులు మరియు దాడి పరిశోధకుల పనిపై ప్రభావం చూపుతున్నాయి.
గత కొన్ని నెలలుగా AI దిగ్గజాలు తమ మోడళ్ళను దురుద్దేశపు హ్యాకర్ల నుంచి రక్షించడానికి ప్రత్యేకంగా పరిశీలించిన ప్రోగ్రామ్లు, కఠినమైన గార్డ్రైళ్స్ ప్రవేశపెట్టాయి. అయితే ఈ పరిమితులు ఇప్పుడు చట్టబద్ధ నెట్వర్క్ రక్షకులు, అలాగే దాడి‑ఆధారిత సైబర్ సెక్యూరిటీ పరిశోధకుల పనిని కూడా అడ్డుకుంటున్నాయి. ఉదాహరణకు, US ప్రభుత్వం Anthropic యొక్క ‘Mythos’ మరియు ‘Fable’ మోడళ్ళపై ఎగుమతి నియంత్రణలు అమలు చేసింది, ఎందుకంటే వాటి గార్డ్రైళ్స్ను బైపాస్ చేసి దుష్ట సైబర్ దాడులు చేయవచ్చని నివేదికలు వచ్చాయి.
OpenAI మరియు Anthropic రెండు సంస్థలూ ‘Trusted Access for Cyber’ మరియు ‘Cyber Verification Program’ వంటి ప్రోగ్రామ్ల ద్వారా, అర్హత కలిగిన పరిశోధకులకు తక్కువ పరిమితులున్న మోడళ్ళను అందిస్తున్నాయి. అయినప్పటికీ, అనేక పరిశోధకులు ఈ గార్డ్రైళ్స్ వారి పనిని నెమ్మదిగా చేస్తుందని ఫిర్యాదు చేస్తున్నారు. మార్క్ డౌడ్, క్రిస్ ఆన్లీ వంటి ప్రసిద్ధ నిపుణులు గార్డ్రైళ్స్ మోడల్ను ప్రశ్నకు సమాధానం ఇవ్వకుండా నిరాకరించటం వల్ల బలహీనతను నిర్ధారించడానికి, దాన్ని దుర్వినియోగం చేయడానికి అవసరమైన సమయమూ, శ్రమను పెంచుతుందని పేర్కొన్నారు.
అందువల్ల, పరిశోధకులు కొన్నిసార్లు గార్డ్రైళ్స్ లేని ఓపెన్‑సోర్స్ AI మోడళ్లను లేదా స్థానికంగా నడిపే మోడళ్లను ఉపయోగించి, సున్నితమైన బలహీనత డేటా లీకేజీ ప్రమాదాన్ని తగ్గిస్తారు. అయితే గార్డ్రైళ్స్ యొక్క అసంగతత, అనుకోని నిరాకరణలు పరిశోధకుల ఉత్పాదకతను తగ్గిస్తాయి, తద్వారా సెక్యూరిటీ రక్షణలో అవరోధంగా మారుతున్నాయి.