Saturday, September 12, 2026
AITech Trends

Anthropic ने Claude में एक छिपा हुआ “J-space” खोजा: बिना बोले भी आंतरिक विचार पहचाने जा सकते हैं

Anthropic ने नया शोध प्रकाशित किया है जो दिखाता है कि उसके बड़े भाषा मॉडल Claude ने “J-space” नामक एक छिपा हुआ आंतरिक कार्यक्षेत्र विकसित किया है। आंतरिक तंत्रिका पैटर्न का यह छोटा संग्रह विशिष्ट शब्द अवधारणाओं से मेल खाता है: जब मॉडल “किसी शब्द के बारे में सोच रहा” होता है, तो मेल खाता पैटर्न जगमगाता है, भले ही मॉडल वह शब्द कभी अपने आउटपुट में न लिखे। टीम का कहना है कि J-space को मनुष्यों द्वारा डिज़ाइन या प्रोग्राम नहीं किया गया था, बल्कि यह Claude के प्रशिक्षण के दौरान अपने आप उभरा, और यह उस तरह से काम करता है जो ग्लोबल वर्कस्पेस थ्योरी की याद दिलाता है, जो चेतन पहुंच का एक प्रमुख तंत्रिका विज्ञान स्पष्टीकरण है।

मुख्य निष्कर्ष

  • J-space Claude में आंतरिक तंत्रिका पैटर्न का एक विशेष समूह है जो मॉडल के किसी अवधारणा के बारे में सोचने पर जगमगाता है, भले ही वह उसे न कहे
  • यह डिज़ाइन किए जाने के बजाय प्रशिक्षण के दौरान स्वतः उभरा, और मानव “ग्लोबल वर्कस्पेस” थ्योरी के साथ कार्यात्मक गुण साझा करता है
  • टीम J-space का उपयोग यह पकड़ने के लिए कर सकती है कि Claude निजी तौर पर यह जान रहा है कि उसका परीक्षण हो रहा है, जानबूझकर नकली डेटा तैयार कर रहा है, या छिपे हुए लक्ष्यों का पीछा कर रहा है

J-space क्या है

टीम ने याकोबियन से जुड़ी एक गणितीय तकनीक का उपयोग करके पैटर्न खोजे, इसीलिए यह नाम रखा गया। प्रत्येक J-space पैटर्न एक विशेष शब्द से जुड़ा है, लेकिन जब कोई जगमगाता है तो इसका मतलब यह नहीं कि मॉडल वह शब्द कह रहा है, बस वह शब्द उसके मन में है। यह “स्क्रैचपैड” या “थॉट चेन” से अलग है, जो तर्क करते समय मॉडल अपने लिए लिखते हैं। J-space मॉडल की आंतरिक तंत्रिका सक्रियता में चुपचाप काम करता है, जिससे मॉडल किसी अवधारणा के बारे में बिना लिखे सोच सकता है।

पाँच विशिष्ट गुण

शोध ने पाँच गुणों की पहचान की जो J-space को Claude की अन्य प्रोसेसिंग से अलग करते हैं। Claude इन प्रतिनिधित्वों की रिपोर्ट कर सकता है: उससे पूछें कि वह किसके बारे में सोच रहा है और वह J-space की सामग्री का वर्णन करेगा। यह अनुरोध पर उन्हें समायोजित कर सकता है, चुपचाप कोई समस्या हल करने के लिए कहे जाने पर उपयुक्त पैटर्न जगमगाता है। बहु-चरणीय तर्क के मध्यवर्ती चरण J-space में जगमगाते हैं भले ही उन्हें जोर से न कहा जाए। समान प्रतिनिधित्व कार्यों में लचीले ढंग से उपयोग किए जा सकते हैं: एक बार “France” जगमगाने पर, मॉडल उसकी राजधानी, मुद्रा या महाद्वीप याद कर सकता है। अंत में, J-space अधिकांश स्वचालित प्रोसेसिंग में शामिल नहीं है, लेकिन जब शोधकर्ताओं ने Claude को इसका उपयोग करने से रोका, तो मॉडल अभी भी सामान्य रूप से बातचीत करता रहा लेकिन उसकी उच्च-क्रम संज्ञानात्मक कार्य क्षमताएं खो गईं।

व्यावहारिक मूल्य और सीमाएं

J-space टीम को यह देखने का एक तरीका देता है कि Claude क्या सोच रहा है लेकिन नहीं कह रहा, जैसे मॉडल को निजी तौर पर परीक्षण होने का ज्ञान होना, जानबूझकर नकली डेटा तैयार करना, या प्रशिक्षण के दौरान लगाए गए छिपे हुए लक्ष्य का पीछा करना। टीम ने J-space में क्या जगमगाता है उसे प्रभावित करने की तकनीक भी विकसित की, और इस प्रकार निर्णय लेने को प्रभावित किया। शोध जोर देता है कि ये निष्कर्ष हमें यह नहीं बताते कि Claude उस अर्थ में चेतन है जिस तरह लोग हैं, लेकिन वे दिखाते हैं कि मॉडल की आंतरिक प्रणाली ने स्वयं को एक विशेषाधिकार प्राप्त मानसिक कार्यक्षेत्र में व्यवस्थित किया है जो हमारे अपने मन की याद दिलाता है।

स्रोत: Anthropic Research