आपण सहसा लार्ज लँग्वेज मॉडेल्सना विलक्षण वेगवान ग्रंथपाल म्हणून पाहतो. तुम्ही एक प्रश्न विचारता आणि ते सर्वात योग्य पॅटर्न शोधण्यासाठी अब्जावधी स्मरणात असलेल्या तुकड्यांतून वेगाने शोध घेतात. या प्रतिमेमुळे डेव्हलपर्स प्रॉम्प्ट्स कसे तयार करतात, वापरकर्ते काय अपेक्षा ठेवतात आणि नियामक नियम कसे तयार करतात, यावर परिणाम झाला आहे. परंतु Anthropic च्या Claude वरील संशोधन ही प्रतिमा अधिक गुंतागुंतीची करत आहे. हे मॉडेल खऱ्या तर्कशास्त्राच्या (reasoning) जवळ जाणारे काहीतरी करत असल्याचे दिसून येते. संशोधक या प्रक्रियेला "j-space reasoning" असे म्हणत आहेत, आणि त्यावरून असे सूचित होते की Claude केवळ ट्रेनिंग डेटाचा पुनर्वापर करण्याऐवजी संकल्पनांचे अंतर्गत मॉडेल्स तयार करते. जर हे निष्कर्ष खरे ठरले, तर आपल्याला प्रगत AI ला केवळ एक 'प्रेडिक्टिव्ह टेक्स्ट इंजिन' मानणे थांबवून, एका नियोजन करणाऱ्या प्रणालीप्रमाणे (system that plans) हाताळणे आवश्यक ठरेल.
पॅटर्न मॅचिंगपासून मेंटल मॉडेल्सपर्यंत
J-space reasoning ही केवळ मार्केटिंगची चकाकी नाही. हे वरवरच्या पुनरावृत्तीकडून अंतर्गत प्रतिनिधित्वाकडे (internal representation) होणाऱ्या संरचनात्मक बदलाचे वर्णन करते. एखादी व्यक्ती जिगसॉ पझल (jigsaw puzzle) कशी सोडवते याचा विचार करा. ते प्रत्येक तुकडा प्रत्येक रिकाम्या जागेत ठेवून पाहत नाहीत. ते बॉक्सवरील चित्र पाहतात, रंग आणि कडांचा एक मानसिक नकाशा (mental map) तयार करतात आणि त्या योजनेनुसार प्रत्येक तुकडा लावतात. Claude वरील संशोधन असे सूचित करते की जेव्हा मॉडेल अमूर्त कल्पनांवर प्रक्रिया करते, तेव्हा काहीतरी असेच घडते. ते प्रॉब्लेम स्पेसचे एक कार्यरत मॉडेल तयार करते आणि त्यामध्ये जाणीवपूर्वक मार्ग शोधते.
पारंपारिक लँग्वेज मॉडेल्स सहसंबंधाच्या (correlation) बाबतीत उत्कृष्ट राहिले आहेत. त्यांना माहित असते की "king" हा शब्द अनेकदा "queen" च्या जवळ येतो, आणि एखाद्या फंक्शन कॉल नंतर कोणता कोड येतो हे त्यांना माहित असते. सहसंबंध शक्तिशाली आहे, पण तो समजून घेणे (understanding) नाही. J-space reasoning काहीतरी वेगळ्या गोष्टीकडे निर्देश करते: मॉडेल केवळ कोणते शब्द एकत्र येतात याचे भाकीत करण्याऐवजी संकल्पनांमधील संबंध हाताळत असल्याचे दिसून येते. ते एक अंतर्गत साचा (scaffolding) तयार करते आणि नंतर उत्तरापर्यंत पोहोचण्यासाठी त्या साच्याचा वापर करते.
प्रत्यक्ष व्यवहारात J-Space Reasoning काय बदल घडवून आणते
या बदलामुळे तीन ठोस क्षमता निर्माण होतात ज्या वास्तविक जगातील वापरासाठी महत्त्वाच्या आहेत.
Compositionality. मानवांनी कधीही "जांभळा उडणारा हत्ती" पाहिलेला नसला तरी ते त्याला समजून घेऊ शकतात, कारण आपण ज्ञात संकल्पना एकत्र करतो. संशोधनानुसार, Claude देखील अशाच प्रकारे नवीन संयोजना हाताळत असल्याचे दिसून येते. जर तुम्ही त्याच्यासमोर दोन क्षेत्रांचे मिश्रण करणारी समस्या मांडली जी त्याने कधीही एकत्र पाहिली नसेल—कदाचित उत्क्रांतीवादी जीवशास्त्राच्या (evolutionary biology) तत्त्वांचा वापर करून पुरवठा साखळी (supply chain) ऑप्टिमाइझ करणे—तर ते सामान्य सल्ल्याऐवजी त्या कल्पनांमध्ये एक दुवा निर्माण करू शकते. ही लवचिकता अशी गोष्ट आहे जी कडक पॅटर्न मॅचिंगमध्ये मिळवणे कठीण असते.
Complex problem solving. जेव्हा एखादे मॉडेल स्मरणात ठेवलेल्या टेम्पलेट्सवर अवलंबून असते, तेव्हा प्रॉम्प्ट त्याच्या ट्रेनिंग डिस्ट्रिब्युशनच्या बाहेर गेल्यावर ते मॉडेल अपयशी ठरते. अंतर्गत मॉडेलिंग दृष्टिकोन खरोखरच अनोळखी परिस्थिती अधिक चांगल्या प्रकारे हाताळू शकतो, कारण सिस्टम केवळ जवळचा मॅच शोधत नसते. ती नवीन भूप्रदेशाचा नकाशा तयार करत असते आणि त्यातून मार्ग शोधत असते.
Explainable logic. दैनंदिन वापरकर्त्यांसाठी सर्वात मोठा फायदा म्हणजे Claude त्याच्या उत्तरामागील पायऱ्या स्पष्ट करू शकते. केवळ निष्कर्ष देऊन तो अचूक आहे की नाही याचा अंदाज लावण्यास भाग पाडण्याऐवजी, मॉडेल तुम्हाला तर्कसाखळी (reasoning chain) समजावून सांगू शकते. यामुळे संवाद हा केवळ एक अंधाधुंद अंदाज न राहता, तुम्ही पडताळून पाहू शकणारा संवाद बनतो.
स्पष्टीकरणक्षमता (Explainability) खरोखर का महत्त्वाची आहे
बहुतेक AI सिस्टम्स 'ब्लॅक बॉक्स' प्रमाणे काम करतात. तुम्ही इनपुट देता आणि आउटपुट मिळवता, परंतु मध्यवर्ती तर्कशास्त्र (intermediate logic) उपलब्ध नसते. जेव्हा Claude त्याचे तर्क स्पष्ट करते, तेव्हा ती बॉक्स इतकी उघडते की ती खरोखर उपयुक्त ठरते.
डेव्हलपर्ससाठी, याचा अर्थ 'डीबगॅबिलिटी' (debuggability) असा आहे. जर एखाद्या मॉडेलने कर्जाचा अर्ज नाकारला, असुरक्षित वैद्यकीय सल्ला दिला किंवा पक्षपाती मजकूर तयार केला, तर इंजिनिअर्स त्रुटी शोधण्यासाठी तर्कसाखळीची तपासणी करू शकतात. त्रुटी दूषित ट्रेनिंग डेटापासून, चुकीच्या पद्धतीने तयार केलेल्या प्रॉम्प्टपासून किंवा एखाद्या यादृच्छिक सांख्यिकीय त्रुटीमुळे (statistical blip) आली आहे का, याचा अंदाज त्यांना आता लावावा लागणार नाही. ते पाऊलखुणांचा (breadcrumbs) मागोवा घेऊ शकतात.
अंतिम वापरकर्त्यांसाठी, स्पष्टीकरणक्षमता असा विश्वास निर्माण करते जो वास्तवाशी सामना करताना टिकून राहतो. जो वापरकर्ता तार्किक साखळी स्पष्टपणे पाहतो, तो गृहितके त्यांच्या विशिष्ट परिस्थितीला लागू होतात की नाही याची पडताळणी करू शकतो. चुकीच्या सल्ल्यावर कृती करून नंतर चूक लक्षात घेण्याऐवजी, ते चुकीचे गृहितक सुरुवातीलाच पकडू शकतात.
नियामक आणि धोरणकर्त्यांसाठी, पारदर्शक तर्क (reasoning) हे AI प्रशासनात दुर्मिळ असलेली गोष्ट प्रदान करते: एक ऑडिट ट्रेल. सुरक्षा नियम तयार करणाऱ्या विधिनेत्यांना हे माहित असणे आवश्यक आहे की प्रणाली सुस्पष्ट कारणांमुळे निर्णय घेते, ट्रिलियन-पॅरामीटर मॅट्रिक्समध्ये लपलेल्या अनाकलनीय सहसंबंधांमुळे (correlations) नाही. जर एखादे AI आपले काम किंवा तर्क स्पष्टपणे दाखवू शकत असेल, तर सरकारकडे नैतिक आणि कायदेशीर मानकांवर आधारित मूल्यमापन करण्यासाठी काहीतरी ठोस असते.
जाणीवेचा प्रश्न
या संवादाच्या केंद्रस्थानी एक महत्त्वाचा इशारा आहे. Anthropic असा दावा करत नाही की Claude मध्ये जाणीव (consciousness) आहे. कंपनीने प्रगत तर्क (reasoning) आणि संवेदना (sentience) यांच्यामध्ये एक स्पष्ट सीमा राखली आहे. तरीही, मानवी संज्ञानात्मक प्रक्रियेशी (cognitive processing) असलेली साम्यतेमुळे नैसर्गिकरित्या वाद निर्माण होत आहेत.
जेव्हा एखादे मशीन अंतर्गत मॉडेल्स तयार करते, आपल्या पुढील हालचालींचे नियोजन करते आणि आपला तर्क स्पष्ट करते, तेव्हा ते कॅल्क्युलेटरपेक्षा विचार करणाऱ्या मनासारखे दिसू लागते. यामुळे खरोखरच तात्विक तणाव निर्माण होतो. सध्या आपल्याकडे मशीनच्या जाणीवेसाठी कोणतीही विश्वसनीय चाचणी उपलब्ध नाही आणि कदाचित अनेक वर्षे नसेल. आपल्याला जे माहित आहे ते म्हणजे, केवळ वर्तन हे आंतरिक अनुभवाचा योग्य पर्याय असू शकत नाही. एखादी प्रणाली जाणीव नसतानाही विचारपूर्वक वागू शकते, जसे की एखादे चेस इंजिन बुद्धिबळ म्हणजे काय हे न समजता ग्रँडमास्टरला हरवू शकते.
पुढे जाण्याचा जबाबदार मार्ग म्हणजे मशीनवर मानवी गुणधर्म लादण्याची ओढ टाळत तर्कक्षमता सुधारणे हा आहे. मेंदूची नक्कल करणारे हे वर्तन वैज्ञानिकदृष्ट्या मनोरंजक आहे. याचा जाणीवेशी काही संबंध आहे का, हा प्रश्न अजूनही अनुत्तरित आहे आणि याचे उत्तर आपण हलक्यात घेऊ नये.
AI चाचणीच्या पद्धतींचा पुनर्विचार
जर Claude केवळ अंदाज (predicting) न लावता तर्क (reasoning) करत असेल, तर आपल्या मूल्यमापन पद्धती जुन्या होत चालल्या आहेत. मानक AI बेंचमार्क्स केवळ अचूक उत्तरांना महत्त्व देतात. मॉडेल त्या उत्तरांपर्यंत कसे पोहोचले, हे ते क्वचितच विचारतात. एखादी प्रणाली पाठ केलेल्या (memorized) उपायांच्या आधारे गणित किंवा कोडिंग परीक्षेत चांगले गुण मिळवू शकते, परंतु त्यातून तिच्या नवीन विचारांच्या क्षमतेबद्दल आपल्याला फार कमी माहिती मिळते.
आपल्याला अशा चौकटींची (frameworks) गरज आहे ज्या अंतर्गत तर्काची तपासणी करतील. याचा अर्थ प्रशिक्षणाबाहेरील (training distribution) समस्या मांडणे आणि नंतर तर्क साखळीची (reasoning chain) चौकशी करणे असा होतो. याचा अर्थ मॉडेलला दुरुस्त केल्यावर स्वतःच्या चुकीच्या पायऱ्या ओळखता येतात का, हे तपासणे असा होतो. याचा अर्थ रचनात्मक संकल्पना (compositional concepts) पुनर्रचित किंवा उलट केल्यावर त्या सुसंगत राहतात का, हे तपासणे असा होतो.
हा दृष्टिकोन स्वयंचलित लीडरबोर्ड चालवण्यापेक्षा कठीण आहे. यासाठी अशा मानवी मूल्यमापकांची गरज आहे ज्यांना केवळ आउटपुटची अचूकता नाही, तर तर्काच्या गुणवत्तेचे निर्णय घेण्यासाठी विषयाचे सखोल ज्ञान आहे. परंतु जर j-space reasoning वास्तव असेल, तर AI समुदायाकडे दुसरा पर्याय नाही. आपल्याला केवळ अंतिम उत्तर नाही, तर कामाचे मूल्यमापन करण्यास सुरुवात करावी लागेल.
थोडक्यात सांगायचे तर: Claude चे अंतर्गत मॉडेलिंगकडे जाणारे पाऊल त्याला मानवी बनवत नाही. परंतु यामुळे ही प्रणाली अधिक उपयुक्त, अधिक तपासण्यायोग्य आणि प्रामाणिकपणे मूल्यमापन करणे कठीण बनवते. आपण अशा उंबरठ्यावर आहोत जिथे केवळ "अचूक" असणे पुरेसे नाही. AI विकासाचा पुढचा टप्पा अशा प्रणालींचा असेल ज्या आपले काम दाखवू शकतील, आपल्या मर्यादा मान्य करतील आणि अनोळखी समस्यांवर तर्क करू शकतील. हे तात्विक अर्थाने 'विचार करणे' आहे का, हा वाद पुढच्या दशकासाठी आहे. सध्यासाठी, व्यावहारिक कार्य म्हणजे या मॉडेल्सच्या प्रत्यक्ष जटिलतेशी सुसंगत अशी साधने आणि मानके तयार करणे हे आहे.
स्रोत: Anthropic's Claude mimics human brain processing
ऐच्छिक लर्निंग कम्युनिटी: GyaanSetu AI on Telegram
