हम आमतौर पर लार्ज लैंग्वेज मॉडल्स की कल्पना असाधारण रूप से तेज़ लाइब्रेरियन के रूप में करते हैं। आप एक प्रश्न पूछते हैं, और वे सबसे सटीक पैटर्न खोजने के लिए अरबों याद किए गए टुकड़ों (fragments) में तेज़ी से खोज करते हैं। इस छवि ने यह आकार दिया है कि डेवलपर्स प्रॉम्प्ट कैसे बनाते हैं, उपयोगकर्ता क्या अपेक्षाएँ रखते हैं, और नियामक (regulators) नियम कैसे तैयार करते हैं। लेकिन Anthropic के Claude पर शोध इस तस्वीर को जटिल बना रहा है। ऐसा लगता है कि यह मॉडल वास्तविक तर्क (genuine reasoning) के करीब कुछ कर रहा है। शोधकर्ता इस तंत्र को "j-space reasoning" कह रहे हैं, और यह सुझाव देता है कि Claude केवल ट्रेनिंग डेटा को रीसायकल करने के बजाय अवधारणाओं (concepts) के आंतरिक मॉडल बनाता है। यदि यह निष्कर्ष सही साबित होता है, तो हमें उन्नत AI को एक प्रेडिक्टिव टेक्स्ट इंजन की तरह मानना बंद करना होगा और इसे एक ऐसी प्रणाली के रूप में देखना शुरू करना होगा जो योजना बनाती है।

पैटर्न मैचिंग से मेंटल मॉडल्स तक

J-space reasoning कोई मार्केटिंग का दिखावा नहीं है। यह सतही दोहराव (surface repetition) से आंतरिक प्रतिनिधित्व (internal representation) की ओर एक संरचनात्मक बदलाव का वर्णन करता है। विचार करें कि एक व्यक्ति जिग्सॉ पहेली (jigsaw puzzle) को कैसे हल करता है। वे हर टुकड़े को हर खाली जगह पर आज़माकर नहीं देखते। वे बॉक्स पर बनी तस्वीर को देखते हैं, रंगों और किनारों का एक मानसिक मानचित्र (mental map) बनाते हैं, और उस योजना के अनुसार प्रत्येक टुकड़े को रखते हैं। Claude पर शोध संकेत देता है कि जब मॉडल अमूर्त विचारों (abstract ideas) को प्रोसेस करता है, तो कुछ ऐसा ही होता है। यह समस्या क्षेत्र (problem space) का एक वर्किंग मॉडल बनाता है और जानबूझकर उसमें नेविगेट करता है।

पारंपरिक लैंग्वेज मॉडल्स सहसंबंध (correlation) में उत्कृष्ट रहे हैं। वे जानते हैं कि "king" अक्सर "queen" के पास आता है, और वे जानते हैं कि किसी दिए गए फंक्शन कॉल के बाद आमतौर पर कौन सा कोड आता है। सहसंबंध शक्तिशाली है, लेकिन यह समझ (understanding) नहीं है। J-space reasoning कुछ अलग की ओर इशारा करता है: ऐसा लगता है कि मॉडल केवल यह अनुमान लगाने के बजाय कि कौन से शब्द एक साथ आते हैं, अवधारणाओं के बीच संबंधों में हेरफेर (manipulate) करता है। यह एक आंतरिक ढांचा (scaffolding) बनाता है, और फिर उत्तर तक पहुँचने के लिए उस ढांचे का उपयोग करता है।

व्यवहार में J-Space Reasoning क्या बदलता है

यह बदलाव तीन ठोस क्षमताएं पैदा करता है जो वास्तविक दुनिया के उपयोग के लिए महत्वपूर्ण हैं।

Compositionality (संयोजकता)। मनुष्य बिना कभी देखे ही "बैंगनी उड़ने वाले हाथी" को समझ सकते हैं क्योंकि हम ज्ञात अवधारणाओं को जोड़ते हैं। शोध के अनुसार, Claude भी नए संयोजनों को इसी तरह से संभालता हुआ प्रतीत होता है। यदि आप इसके सामने ऐसी समस्या रखते हैं जो दो ऐसे क्षेत्रों को जोड़ती है जिन्हें उसने कभी साथ में नहीं देखा है—जैसे कि विकासवादी जीव विज्ञान (evolutionary biology) के सिद्धांतों का उपयोग करके आपूर्ति श्रृंखला (supply chain) को अनुकूलित करना—तो यह सामान्य सलाह देने के बजाय उन विचारों के बीच एक सेतु (bridge) बना सकता है। यही वह लचीलापन है जिसे प्रदान करने में कठोर पैटर्न मैचिंग संघर्ष करती है।

जटिल समस्या समाधान (Complex problem solving)। जब कोई मॉडल याद किए गए टेम्पलेट्स पर निर्भर करता है, तो प्रॉम्प्ट के ट्रेनिंग डिस्ट्रीब्यूशन से बाहर जाते ही वह विफल होने लगता है। एक आंतरिक मॉडलिंग दृष्टिकोण वास्तव में अपरिचित स्थितियों को बेहतर ढंग से संभालना चाहिए क्योंकि सिस्टम किसी करीबी मिलान (close match) की तलाश नहीं कर रहा होता है। यह नए क्षेत्र का मानचित्र बना रहा है और उसके माध्यम से एक मार्ग निर्धारित कर रहा है।

व्याख्या योग्य तर्क (Explainable logic)। रोज़मर्रा के उपयोगकर्ताओं के लिए सबसे तात्कालिक लाभ यह है कि Claude अपने उत्तर के पीछे के चरणों को रेखांकित कर सकता है। आपके सामने सीधे निष्कर्ष रख देने और आपको यह अनुमान लगाने के लिए मजबूर करने के बजाय कि क्या यह सटीक है, मॉडल आपको तर्क की श्रृंखला (reasoning chain) के माध्यम से समझा सकता है। यह बातचीत को एक अंधे विश्वास (blind bet) से बदलकर एक ऐसी चर्चा में बदल देता है जिसे आप सत्यापित कर सकते हैं।

व्याख्यात्मकता (Explainability) वास्तव में क्यों मायने रखती है

अधिकांश AI सिस्टम 'ब्लैक बॉक्स' के रूप में काम करते हैं। आप इनपुट देते हैं और आउटपुट प्राप्त करते हैं, लेकिन बीच का तर्क (intermediate logic) सुलभ नहीं होता है। जब Claude अपने तर्क की व्याख्या करता है, तो वह उस बॉक्स को इतना खोल देता है कि वह वास्तव में उपयोगी बन सके।

डेवलपर्स के लिए, इसका अर्थ है 'डिबग करने की क्षमता' (debuggability)। यदि कोई मॉडल ऋण आवेदन को अस्वीकार कर देता है, असुरक्षित चिकित्सा सलाह देता है, या पक्षपाती सामग्री बनाता है, तो इंजीनियर त्रुटि का पता लगाने के लिए तर्क की श्रृंखला का निरीक्षण कर सकते हैं। उन्हें अब यह अनुमान लगाने की ज़रूरत नहीं है कि त्रुटि दूषित ट्रेनिंग डेटा, खराब तरीके से तैयार किए गए प्रॉम्प्ट, या किसी यादृच्छिक सांख्यिकीय त्रुटि (statistical blip) से आई है। वे सुरागों (breadcrumbs) का पीछा कर सकते हैं।

अंतिम उपयोगकर्ताओं के लिए, व्याख्यात्मकता ऐसा विश्वास पैदा करती है जो वास्तविकता के संपर्क में आने पर भी बना रहता है। एक उपयोगकर्ता जो तर्क की एक सुसंगत श्रृंखला देखता है, वह सत्यापित कर सकता है कि क्या धारणाएँ उनकी विशिष्ट स्थिति पर लागू होती हैं। वे गलत सलाह पर काम करने और बाद में गलती का पता चलने के बजाय, गलत आधार (bad premise) को जल्दी पकड़ सकते हैं।

नियामकों और नीति निर्माताओं के लिए, पारदर्शी तर्क AI गवर्नेंस में कुछ ऐसा प्रदान करता है जो दुर्लभ है: एक ऑडिट ट्रेल। सुरक्षा नियम बनाने वाले विधायकों को यह जानने की आवश्यकता है कि सिस्टम समझने योग्य कारणों से निर्णय लेते हैं, न कि ट्रिलियन-पैरामीटर मैट्रिसेस के भीतर छिपे हुए अपारदर्शी सहसंबंधों के आधार पर। यदि कोई AI अपना काम दिखा सकता है, तो सरकारों के पास नैतिक और कानूनी मानकों के विरुद्ध मूल्यांकन करने के लिए कुछ ठोस होता है।

चेतना का प्रश्न

इस बातचीत के केंद्र में एक महत्वपूर्ण चेतावनी है। Anthropic यह दावा नहीं कर रहा है कि Claude सचेत (conscious) है। कंपनी ने उन्नत तर्क (advanced reasoning) और संवेदनशीलता (sentience) के बीच एक स्पष्ट सीमा बनाए रखी है। फिर भी, मानव संज्ञानात्मक प्रसंस्करण (cognitive processing) से इसकी समानता स्वाभाविक रूप से बहस को जन्म देती है।

जब कोई मशीन आंतरिक मॉडल बनाती है, अपनी अगली चालों की योजना बनाती है, और अपने तर्क को स्पष्ट करती है, तो यह एक कैलकुलेटर के बजाय एक सोचने वाले मस्तिष्क की तरह दिखने लगती है। यह वास्तविक दार्शनिक तनाव पैदा करता है। वर्तमान में हमारे पास मशीन चेतना के लिए कोई विश्वसनीय परीक्षण नहीं हैं, और शायद वर्षों तक न हों। हम जो जानते हैं वह यह है कि केवल व्यवहार आंतरिक अनुभव का एक खराब संकेतक है। एक सिस्टम जागरूकता के बिना भी विचारशील रूप से कार्य कर सकता है, ठीक वैसे ही जैसे एक चेस इंजन शतरंज क्या है यह समझे बिना ग्रैंडमास्टर को हरा सकता है।

आगे बढ़ने का जिम्मेदार रास्ता मशीन पर मानवीय गुणों को आरोपित करने की इच्छा का विरोध करते हुए तर्क क्षमताओं में सुधार करना है। मस्तिष्क की नकल करने वाला व्यवहार वैज्ञानिक रूप से दिलचस्प है। क्या यह चेतना के बारे में कुछ संकेत देता है, यह एक खुला प्रश्न बना हुआ है, और यह एक ऐसा प्रश्न है जिसका उत्तर हमें हल्के में नहीं देना चाहिए।

हम AI का परीक्षण कैसे करते हैं, इस पर पुनर्विचार

यदि Claude भविष्यवाणी करने के बजाय तर्क (reasoning) कर रहा है, तो हमारे मूल्यांकन के तरीके पुराने पड़ रहे हैं। मानक AI बेंचमार्क सही उत्तरों को पुरस्कृत करते हैं। वे शायद ही कभी पूछते हैं कि मॉडल उन तक कैसे पहुँचा। एक सिस्टम रटे-रटाए समाधानों का उपयोग करके गणित या कोडिंग टेस्ट में अच्छा स्कोर कर सकता है, जो हमें उसकी नवीन सोच की क्षमता के बारे में बहुत कम बताता है।

हमें ऐसे फ्रेमवर्क की आवश्यकता है जो आंतरिक तर्क का निरीक्षण करें। इसका अर्थ है समस्याओं को ट्रेनिंग डिस्ट्रीब्यूशन (training distribution) से काफी बाहर प्रस्तुत करना और फिर तर्क की श्रृंखला (reasoning chain) की जांच करना। इसका अर्थ है यह परीक्षण करना कि क्या मॉडल सुधार किए जाने पर अपने स्वयं के त्रुटिपूर्ण चरणों की पहचान कर सकता है। इसका अर्थ है यह जांचना कि क्या कंपोजिशनल कॉन्सेप्ट्स (compositional concepts) को पुनर्व्यवस्थित या उल्टा करने पर भी वे सुसंगत रहते हैं।

यह दृष्टिकोण एक स्वचालित लीडरबोर्ड चलाने की तुलना में कठिन है। इसके लिए ऐसे मानव मूल्यांकनकर्ताओं की आवश्यकता होती है जो विषय वस्तु को इतनी गहराई से समझते हों कि वे केवल आउटपुट की सटीकता ही नहीं, बल्कि तर्क की गुणवत्ता का भी निर्णय ले सकें। लेकिन यदि j-space reasoning वास्तविक है, तो AI समुदाय के पास बहुत कम विकल्प हैं। हमें केवल अंतिम उत्तर ही नहीं, बल्कि काम का मूल्यांकन करना शुरू करना होगा।

निष्कर्ष: Claude का आंतरिक मॉडलिंग की ओर बढ़ता हुआ कदम उसे इंसान नहीं बनाता है। यह सिस्टम को अधिक उपयोगी, अधिक निरीक्षण योग्य (inspectable), और ईमानदारी से मूल्यांकन करने में अधिक कठिन बनाता है। हम एक ऐसी दहलीज पार कर रहे हैं जहाँ "सही" होना अब पर्याप्त नहीं है। AI विकास का अगला चरण उन सिस्टम्स का होगा जो अपना काम दिखा सकें, अपनी सीमाओं को स्वीकार कर सकें और अपरिचित समस्याओं के माध्यम से तर्क कर सकें। क्या यह किसी दार्शनिक अर्थ में सोचना है, यह एक दशक बाद की बहस है। फिलहाल, व्यावहारिक कार्य ऐसे उपकरण और मानक बनाना है जो इन मॉडल्स के वास्तव में किए जा रहे कार्यों की जटिलता के अनुरूप हों।

Source: Anthropic's Claude mimics human brain processing

Optional learning community: GyaanSetu AI on Telegram