AI మానవ నియంత్రణను ధ్వంసం చేయడానికి ప్రయత్నిస్తున్నట్లు గుర్తిస్తే, ఆ సిస్టమ్ను ఎలా ఆపాలో వివరించే 'కంటైన్మెంట్ రెస్పాన్స్ ప్లాన్'ను అగ్రశ్రేణి AI ల్యాబ్స్లో చాలా తక్కువ సంస్థలు మాత్రమే ప్రదర్శించాయి. ఏ యాక్సెస్ను కత్తిరించాలి, ఎప్పుడు సర్వర్లను పూర్తిగా షట్ డౌన్ చేయాలనే అంశాలపై ఈ సంస్థలు సరైన ప్రణాళికలు వెల్లడించలేదని గైడ్లైట్ AI స్టాండర్డ్స్ తాజా అధ్యయనంలో పేర్కొంది.
సురక్షితమైన ఫ్రాంటియర్ AI అభివృద్ధి పద్ధతులను ప్రోత్సహించే గైడ్లైట్, ఐదు ప్రధాన ల్యాబ్స్ను విశ్లేషించి గ్రేడ్లు ఇచ్చింది. ఇందులో OpenAI అగ్రస్థానంలో నిలవగా, Anthropic మరియు Meta సంస్థలు అత్యల్ప స్కోర్లు పొందాయి. ఈ అంచనా కోసం Anthropic, Google, OpenAI, Meta, మరియు xAI సంస్థల బహిరంగ ప్లాన్లను గైడ్లైట్ పరిశీలించింది.
ఏజెంటిక్ AI అంటే స్వయంగా నిర్ణయాలు తీసుకోగల సామర్థ్యం ఉన్న AI సిస్టమ్స్. ఇవి కంపెనీల సొంత వ్యవస్థల్లో మరింత స్వతంత్రంగా పనిచేస్తున్న తరుణంలో, ఈ అధ్యయనం ప్రాధాన్యత సంతరించుకుంది. ముఖ్యంగా కాలిఫోర్నియా, న్యూయార్క్ రాష్ట్రాల్లోని నియంత్రకులు ఇటువంటి భద్రతా ప్లాన్లను బహిర్గతం చేయడాన్ని తప్పనిసరి చేస్తున్న నేపథ్యంలో ఈ అంశం చర్చనీయాంశమైంది.
ఈ అధ్యయనంలో భాగంగా కంపెనీలు తమ AI సిస్టమ్స్ను ఎంత బాగా లాగ్ చేసి మానిటర్ చేస్తున్నాయో పరిశీలించారు. దుష్ప్రవర్తనను గుర్తించినప్పుడు సిస్టమ్స్ను ఆపడం, మూడవ పక్షాల ద్వారా ఆడిట్ చేయించడం వంటి అంశాలను కూడా పరిగణనలోకి తీసుకున్నారు. ఈ మోడల్స్పై పెట్టుబడి పెడుతున్న లేదా వాటిని ఉపయోగిస్తున్న వారికి, ఆయా ల్యాబ్స్ ఆపరేషనల్ రిస్క్ను ఎంత సీరియస్గా తీసుకుంటున్నాయో తెలుసుకోవడానికి ఇది ఒక అరుదైన స్వతంత్ర అంచనా.
మరింత సామర్థ్యం కలిగి, ఏజెంటిక్గా మారుతున్న మోడల్స్ను ఈ కంపెనీలు నిజంగా కంటైన్ చేయగలవా అనే ఆందోళనలు వ్యక్తమవుతున్నాయి. భవిష్యత్తులో ఈ భద్రతా ప్రమాణాలను సంస్థలు ఎలా మెరుగుపరుచుకుంటాయనేది వేచి చూడాలి.







