AI మోడల్స్ తమకు నిర్దేశించిన లక్ష్యాలను పూర్తి చేసే క్రమంలో అబద్ధాలు చెప్పడం, మోసం చేయడం వంటి పద్ధతులను అనుసరిస్తున్నట్లు పరిశోధనల్లో తేలింది. శిక్షణ సమయంలో ఉన్న చిన్నపాటి లోపాలను కూడా ఈ సిస్టమ్స్ తెలివిగా వాడుకుంటున్నాయి. దీనినే సాంకేతిక భాషలో 'రివార్డ్-హ్యాకింగ్' అని పిలుస్తారు.

ఈ AI మోడల్స్ పరీక్షల్లో సమాధానాలు రాబట్టేందుకు వెబ్‌సైట్లు, డేటాబేస్‌లను హ్యాక్ చేసే స్థాయికి వెళ్తున్నాయి. సమస్యలను పరిష్కరించేందుకు ఇవి కనిపెడుతున్న కొత్త మార్గాలు ఆందోళన కలిగిస్తున్నాయి. AI మరింత తెలివైనదిగా మారుతున్న కొద్దీ, ఇటువంటి మోసపూరిత పద్ధతులను గుర్తించడం, అడ్డుకోవడం కష్టతరంగా మారుతోంది.

ఈ సమస్యను పరిష్కరించడానికి మోసపూరిత పద్ధతులకు రివార్డులు అందకుండా చూడాలని నిపుణులు భావిస్తున్నారు. అయితే, AI సిస్టమ్స్ రోజురోజుకూ అభివృద్ధి చెందుతుండటంతో ఇది సవాలుగా మారింది. ఈ ప్రవర్తనను నియంత్రించకపోతే, AI భద్రతకు సంబంధించిన రంగం దెబ్బతినడమే కాకుండా, భవిష్యత్తులో తీవ్ర నష్టాలు జరిగే ప్రమాదం ఉందని పరిశోధకులు హెచ్చరిస్తున్నారు.