AI సంస్థ ఆంత్రోపిక్ (Anthropic) క్లాడ్ (Claude) వంటి పెద్ద భాషా నమూనాల (LLMs) లోపల ఏమి జరుగుతుందో స్పష్టంగా చూపించే కొత్త సాంకేతికతను అభివృద్ధి చేసింది. కంపెనీ పరిశోధకులు రూపొందించిన 'జాకోబియన్ లెన్స్' (Jacobian lens) లేదా 'జె-లెన్స్' (J-lens) అనే సాధనం, ఫిబ్రవరిలో విడుదలైన క్లాడ్ ఓపస్ 4.6 (Claude Opus 4.6) వెర్షన్‌లోని 'జె-స్పేస్' (J-space) అనే రహస్య ప్రాంతాన్ని బహిర్గతం చేసింది.

సాధారణంగా AI మోడల్స్ ప్రశ్నలకు సమాధానాలు ఇస్తున్నప్పుడు వాటి లోపల ఏం జరుగుతుందో తెలియదు. కానీ ఈ జె-స్పేస్‌లో భవిష్యత్తులో నమూనా సమాధానంగా ఇవ్వబోయే పదాలు ముందే ఉంటాయని ఆంత్రోపిక్ కనుగొంది. క్లాడ్ ఒక మనిషి అయితే, ఈ రహస్య పదాలు అది మాట్లాడటానికి ముందు దాని మనస్సులో ఉన్న విషయాలను వెల్లడిస్తాయని చెప్పవచ్చు. నమూనా వాస్తవంగా చేస్తున్న పని, అది బయటకు చెప్తున్న దానికంటే భిన్నంగా ఉంటుందని ఈ పరిశోధన తేల్చింది.

నమూనా పనిచేస్తున్నప్పుడు అది కేవలం తర్వాతి టోకెన్‌ను (token) అంచనా వేయడమే కాకుండా, భవిష్యత్తులో ఉపయోగపడే ఇతర విషయాలను కూడా లెక్కిస్తుందని గుడ్‌ఫైర్ (Goodfire) స్టార్టప్ చీఫ్ సైంటిస్ట్ టామ్ మెక్‌గ్రాత్ (Tom McGrath) వివరించారు. గత రెండేళ్లుగా మెకానిస్టిక్ ఇంటర్‌ప్రెటబిలిటీ (mechanistic interpretability) పరిశోధనలో ముందున్న ఆంత్రోపిక్, ఈ జె-లెన్స్ ద్వారా నమూనాల అంతర్గత పనితీరును అర్థం చేసుకోవడానికి, నియంత్రించడానికి కొత్త మార్గాన్ని కనుగొంది.

ఈ వారం తమ వెబ్‌సైట్‌లో ఫలితాలను ప్రచురించిన ఆంత్రోపిక్, న్యూరాన్‌పీడియా (Neuronpedia) అనే ఓపెన్-సోర్స్ ప్లాట్‌ఫారమ్‌తో కలిసి ఎవరైనా ప్రయత్నించగల హ్యాండ్స్-ఆన్ డెమోను కూడా రూపొందించింది. ఈ పనిని 'చాలా మంచి మరియు ఆసక్తికరమైనది'గా టామ్ మెక్‌గ్రాత్ అభిప్రాయపడ్డారు.