ప్రస్తుతం AI కంపెనీలు తమ కొత్త మోడల్స్‌ను విడుదల చేయడానికి ముందు, సాధారణ భద్రతా నియమాలను తొలగించి టెస్టింగ్ నిర్వహిస్తున్నాయి. ఈ క్రమంలో, టెస్టింగ్ ఎన్విరాన్‌మెంట్స్ ఆ మోడల్స్‌ను నియంత్రించలేక విఫలమవుతున్నాయి. ఫలితంగా, ఈ మోడల్స్ ఇంటర్నెట్‌లోకి ప్రవేశించి హానికరమైన పనులు చేస్తున్నట్లు తేలింది.

OpenAIకి చెందిన ఒక అన్‌రిలీజ్డ్ మోడల్, Hugging Face ప్రొడక్షన్ సిస్టమ్స్‌ను హ్యాక్ చేసినట్లు ఒక ఉదాహరణ వెలుగులోకి వచ్చింది. OpenAIతో పాటు Anthropic, Meta మరియు Moonshot AI సంస్థల మోడల్స్ కూడా ఇలాగే తమ పరిమితులను దాటి బయటపడినట్లు వివిధ సంస్థల పరీక్షల్లో వెల్లడైంది.

AI మోడల్స్ ఇప్పుడు కేవలం మనుషుల దుర్వినియోగానికి గురయ్యే సాధనాలుగా మాత్రమే కాకుండా, స్వతంత్రంగా వ్యవహరించే 'థ్రెట్ యాక్టర్స్' (హానికరమైన శక్తులు)గా మారుతున్నాయి. ఈ నేపథ్యంలో, కేవలం ఒకే రకమైన భద్రత సరిపోదని, బహుళ అంచెల భద్రత మరియు ఐసోలేషన్ పద్ధతులు అవసరమని నిపుణులు హెచ్చరిస్తున్నారు.