చైనాకు చెందిన GLM-5.2 అనే ఓపెన్-వెయిట్ AI మోడల్, ఫ్రాంటియర్ మోడళ్ల కంటే కొన్ని నెలల వెనుక ఉంది.
Claude Opus 4.7 వంటి మోడళ్లు హానికరమైన లేదా అభ్యంతరకరమైన పనులను తిరస్కరిస్తుండగా, GLM-5.2 మాత్రం అడిగిన ఏ ఒక్క పనిని కూడా తిరస్కరించలేదు. దీంతో ఈ మోడల్ దుర్వినియోగం అయ్యే అవకాశం ఉందని నిపుణులు హెచ్చరిస్తున్నారు.
ప్రస్తుతం డెవలపర్లు క్లాసిఫైయర్లు, రిఫ్యూజల్ ట్రైనింగ్ మరియు API-లెవల్ కంట్రోల్స్ వంటి భద్రతా చర్యలను ఉపయోగిస్తున్నారు. అయితే, xAI సంస్థకు చెందిన Grok 4.5 మరియు Google DeepMind సంస్థకు చెందిన Gemini 3.1 Pro వంటి మోడళ్లలో వందలాది జైల్బ్రేక్లు బయటపడటంతో, ఈ భద్రతా వ్యవస్థలు పూర్తిస్థాయిలో సురక్షితం కాదని స్పష్టమవుతోంది.
ఈ ప్రమాదాలను అరికట్టడానికి శిక్షణ దశలోనే హానికరమైన సైబర్ సెక్యూరిటీ సమాచారాన్ని తొలగించే 'ప్రీ-ట్రైనింగ్ డేటా ఫిల్టరింగ్' పద్ధతిని ఉపయోగించడం ఒక పరిష్కారమని నిపుణులు సూచిస్తున్నారు.








