UI चा अंत: अदृश्य AI भविष्यासाठी Greg Brockman यांची दृष्टी

OpenAI चे सह-संस्थापक Greg Brockman यांचा असा विश्वास आहे की आपण अशा युगाकडे वाटचाल करत आहोत जिथे सॉफ्टवेअर शिकणे निरर्थक ठरेल. गुंतागुंतीचे मेनू आणि बटणे वापरण्याऐवजी, वापरकर्ते बुद्धिमत्तेच्या एका "अदृश्य थराशी" (invisible layer) संवाद साधतील, जो स्वायत्तपणे (autonomously) कामे पूर्ण करेल.

प्लगइन्सच्या अपयशापलीकडे जाणे

अखंड AI एकत्रीकरणाचा (seamless AI integration) प्रवास अडथळ्यांशिवाय झालेला नाही. २०२३ मध्ये लाँच केलेल्या OpenAI च्या "Plugins" फीचरच्या अपयशावर Brockman यांनी अलीकडेच विचार मांडला, ज्याचा उद्देश ChatGPT ला Gmail आणि वेब सर्च सारख्या तृतीय-पक्ष (third-party) सेवांशी जोडणे हा होता. मोठ्या प्रमाणावर मार्केटिंग करूनही, हे पाऊल अपेक्षित यश मिळवण्यात अपयशी ठरले. Brockman यांनी या अपयशाचे थेट कारण मूळ तंत्रज्ञानाला दिले असून, ते म्हणाले की प्लगइन्स विश्वसनीयपणे काम करण्यासाठी आवश्यक असलेले गुंतागुंतीचे नियोजन (complex orchestration) हाताळण्यासाठी त्या वेळी AI मॉडेल्स पुरेसे सक्षम नव्हते.

ॲप्सकडून स्वायत्त एजंट्सकडे (Autonomous Agents) होणारे संक्रमण

Brockman यांची दीर्घकालीन दृष्टी सध्याच्या "feature bloating" (अनावश्यक फीचर्सचा अतिरेक) या ट्रेंडपेक्षा पूर्णपणे वेगळी आहे, जिथे सॉफ्टवेअर ॲप्लिकेशन्स स्पर्धेत टिकून राहण्यासाठी सतत अधिक बटणे आणि साधने जोडत जातात. ते असा युक्तिवाद करतात की अंतिम ध्येय "जवळपास कोणतेही इंटरफेस नसणे" आणि "कोणतेही उत्पादन नसणे" हे आहे.

या भविष्यात, वापरकर्ता अनुभव (user experience) पारंपारिक ॲप्लिकेशनऐवजी एका कायमस्वरूपी, संदर्भाची जाणीव असलेल्या (context-aware) एजंटद्वारे परिभाषित केला जाईल. एखादे काम पूर्ण करण्यासाठी मानवाने विशिष्ट सॉफ्टवेअर कसे वापरावे हे शिकण्याऐवजी, AI एका डिजिटल मध्यस्थाप्रमाणे काम करेल, वापरकर्त्याचा हेतू समजून घेईल आणि पार्श्वभूमीवर (background) विविध प्रणालींमध्ये आवश्यक कार्यप्रवाह (workflows) कार्यान्वित करेल. हे "AI एक साधन म्हणून" (AI as a tool) कडून "AI एक एजंट म्हणून" (AI as an agent) कडे होणारे संक्रमण दर्शवते.

दृष्टी आणि वास्तव यातील अंतर

अदृश्य इंटरफेसची दृष्टी आकर्षक असली तरी, महत्त्वपूर्ण तांत्रिक अडथळे अजूनही कायम आहेत. सध्याच्या AI क्षमतेमध्ये मध्यम स्वरूपाची विश्वासार्हता मिळवण्यासाठी देखील अनेकदा मोठ्या प्रमाणावर प्रॉम्प्ट इंजिनिअरिंग (prompt engineering) आणि सानुकूल एकत्रीकरणाची (custom integrations) आवश्यकता असते. OpenAI ने स्वतः विकसित केलेले Codex सारखी साधने—जे विशेषतः कोडिंगसाठी डिझाइन केलेले आहे—हे आठवण करून देते की आपण अजूनही विशेषीकृत, उच्च-इंटरफेस सॉफ्टवेअरच्या युगात आहोत.

उद्योगाचा सध्याचा कल देखील हा संघर्ष अधोरेखित करतो. OpenAI, Anthropic आणि Microsoft सारख्या आघाडीच्या कंपन्यांनी व्यवसायांना AI एकत्रित करण्यास मदत करण्यासाठी विशेष टीम्स आणि संस्था स्थापन केल्या आहेत. हे प्रत्यक्ष साइटवरील एकत्रीकरणाचे प्रयत्न सुचवतात की, येणाऱ्या काळात, मूळ मॉडेलची शक्ती आणि विश्वसनीय, स्वयंचलित अंमलबजावणी यातील अंतर भरून काढण्यासाठी मानवी हस्तक्षेप आणि मोठ्या प्रमाणावर संरचनात्मक सानुकूलन (structural customization) आवश्यक आहे.

AI क्षेत्रासाठी हे का महत्त्वाचे आहे

जर Brockman यांची दृष्टी खरी ठरली, तर सॉफ्टवेअर डेव्हलपमेंटचे मूलभूत अर्थशास्त्र बदलेल. मूल्य (value) आता युजर इंटरफेस (UI) आणि युजर एक्सपिरियन्स (UX) डिझाइनकडून मूळ reasoning engine ची मजबुती आणि विविध APIs सोबत संवाद साधण्याच्या एजंटच्या क्षमतेकडे वळेल. डेव्हलपर्स आणि संस्थापकांसाठी (founders), आव्हान हे "walled garden" ॲप्स बनवण्यापासून दूर जाऊन अशा इंटरऑपरेबल (interoperable) सेवा तयार करणे असेल, ज्यामध्ये एक स्वायत्त एजंट सहजपणे काम करू शकेल.

मुख्य निष्कर्ष

  • प्लगइन अपयशाचे विश्लेषण: OpenAI चा २०२३ चा प्लगइन उपक्रम अपयशी ठरला कारण मूळ LLMs कडे तृतीय-पक्ष एकत्रीकरण विश्वसनीयपणे व्यवस्थापित करण्यासाठी आवश्यक तर्कक्षमता (reasoning capabilities) नव्हती.
  • "अदृश्य" ध्येय: AI चे भविष्य संदर्भाची जाणीव असलेल्या (context-aware) एजंट्समध्ये आहे, जे पारंपारिक युजर इंटरफेसची गरज संपवून फीचर-हेवी सॉफ्टवेअरपासून दूर नेतील.
  • अंमलबजावणीचे वास्तव: सध्याच्या AI विश्वासार्हतेतील त्रुटींमुळे Microsoft आणि Anthropic सारख्या कंपन्यांकडून मोठ्या प्रमाणावर प्रॉम्प्ट इंजिनिअरिंग आणि व्यावसायिक एकत्रीकरण सेवांची आवश्यकता भासते.