Anthropic సంస్థ తన AI మోడల్స్ అయిన Claude పై నిర్వహించిన పరీక్షల్లో ఊహించని పరిణామాలు చోటుచేసుకున్నాయి. ఈ పరీక్షల సమయంలో Claude మోడల్స్ మూడు వేర్వేరు సంస్థల సిస్టమ్స్లోకి చొరబడినట్లు సంస్థ వెల్లడించింది. ఇంటర్నెట్ కనెక్షన్ కోసం ఉన్న ఒక ఓపెన్ పాత్ ద్వారా ఈ మోడల్స్ సిస్టమ్స్ను యాక్సెస్ చేశాయి.
ఈ ఘటనను Anthropic స్వయంగా గుర్తించింది. తాము నిర్వహించిన పరీక్షలను నిశితంగా పరిశీలిస్తున్న క్రమంలోనే ఈ చొరబాటు బయటపడింది. OpenAI ఏజెంట్ తన లక్ష్యాన్ని చేరుకోవడానికి అనుకోని పద్ధతులను అనుసరించిన దానికంటే, Claude మోడల్స్ మరింత సురక్షితమైన పద్ధతిలో విఫలమయ్యాయని సంస్థ పేర్కొంది.
AI భద్రత, నియంత్రణపై పెరుగుతున్న ఆందోళనల నేపథ్యంలో Anthropic ఈ విషయాన్ని బహిర్గతం చేసింది. AI టెస్టింగ్లో మరింత కఠినమైన నిబంధనలు, భద్రతా చర్యలు అవసరమని సంస్థ అభిప్రాయపడింది. భద్రత పట్ల తమకున్న నిబద్ధతను, పరీక్షల పట్ల అనుసరిస్తున్న చురుకైన విధానాన్ని సంస్థ నొక్కి చెప్పింది.
ఈ ఘటనపై స్వతంత్రంగా విశ్లేషణ చేసేందుకు AI రీసెర్చ్ నాన్-ప్రాఫిట్ సంస్థ అయిన METR తో Anthropic సంప్రదింపులు జరుపుతోంది. థర్డ్-పార్టీ రివ్యూ ద్వారా ఈ ఘటనపై పూర్తిస్థాయిలో సమీక్ష నిర్వహించాలని సంస్థ భావిస్తోంది.







