Anthropic के नवीनतम अध्ययन से पता चलता है कि जो डेवलपर्स कोड जनरेशन के लिए AI पर निर्भर रहते हैं, वे कॉन्सेप्ट-समझने (concept-understanding) के परीक्षणों में 17 प्रतिशत कम स्कोर करते हैं और उन साथियों की तुलना में कार्यों को तेजी से पूरा नहीं करते जो डॉक्यूमेंटेशन और वेब सर्च पर भरोसा करते हैं। ये निष्कर्ष इस बात को रेखांकित करते हैं कि हालांकि AI कुछ ही सेकंड में काम करने वाला कोड तैयार कर सकता है, लेकिन यह वास्तविक इंजीनियरिंग विशेषज्ञता की लागत को कम नहीं करता है।

यह अध्ययन क्यों महत्वपूर्ण है

इस प्रयोग में डेवलपर्स को दो समूहों (cohorts) में विभाजित किया गया। एक समूह को AI कोड-जनरेशन टूल तक अबाध पहुंच प्राप्त थी; दूसरे समूह ने केवल आधिकारिक डॉक्यूमेंटेशन और इंटरनेट सर्च का उपयोग करके उन्हीं समस्याओं को हल किया। असाइनमेंट के बाद, प्रतिभागियों ने बुनियादी सिद्धांतों की समझ को परखने के लिए एक क्विज़ दिया। AI-सहायता प्राप्त समूह का औसत स्कोर 17 प्रतिशत कम रहा, और किसी भी समूह ने गति में कोई मापने योग्य बढ़त नहीं दिखाई।

व्यावहारिक रूप से, “vibe coding”—यानी AI को एक स्निपेट (snippet) बनाने के लिए प्रॉम्प्ट देना और बिना गहन जांच के उसे लागू कर देना—उत्पादकता नहीं बढ़ाता है। यह केवल ज्ञान के उस अंतर को छिपाता है जो बाद में बग्स, मेंटेनेंस की समस्याओं या महंगे रीराइट्स (rewrites) के रूप में सामने आता है।

आंकड़ों के पीछे का संदर्भ

Anthropic का शोध दिखाता है कि इसका वादा अधूरा है। जिन प्रतिभागियों ने हर कदम के लिए AI का उपयोग किया—सुझावों को कॉपी-पेस्ट करना, वेरिएबल नामों में बदलाव करना और आगे बढ़ जाना—उन्होंने समस्या क्षेत्र (problem domain) के बारे में सबसे कम सीखा। जिन डेवलपर्स ने टूल को एक सहयोगी के रूप में माना—सटीक और सीमित प्रश्न पूछे और फिर प्राप्त कोड का विश्लेषण किया—उन्होंने वैचारिक ढांचे (conceptual framework) को बेहतर ढंग से समझा।

यह अंतर उद्योग के एक व्यापक अवलोकन को दर्शाता है: प्रॉम्प्ट इंजीनियर्स मिनटों में एक फंक्शन तैयार कर सकते हैं, लेकिन जैसे-जैसे जटिलता बढ़ती है, एक सिस्टम इंजीनियर अधिक तेजी से काम करता है। वे अनुमान लगा सकते हैं कि क्या टूटेगा और क्या स्केल करने में विफल रहेगा। उनकी गति उनके निर्णय लेने की क्षमता (judgment) को दर्शाती है, अक्षमता को नहीं।

कौन जीतता है, कौन हारता है

वे इंजीनियर्स जो निर्णय लेने की क्षमता बनाए रखते हैं वे इंजीनियर्स जो आर्किटेक्चर को समझते हैं, जानते हैं कि संरचनाएं कहाँ कठोर होनी चाहिए या कहाँ लचीली, और सिस्टम को तोड़े बिना कंपोनेंट्स को फिर से लिख सकते हैं, वे लंबे समय में संगठनों के पैसे बचाते हैं। उनका कौशल उस छिपे हुए तकनीकी ऋण (technical debt) से बचाता है जो अक्सर AI-जनरेटेड कोड के बाद आता है, जो दिखने में तो साफ लगता है लेकिन उसमें स्पष्ट उद्देश्य की कमी होती है।

प्रॉम्प्ट स्पेशलिस्ट जो लोग AI को जादू की छड़ी की तरह मानते हैं, वे त्वरित प्रोटोटाइप दे सकते हैं या अलग-थलग बग्स को हल कर सकते हैं। अल्पावधि में, वे उत्पादक दिखाई देते हैं, लेकिन जब कोडबेस का विस्तार होता है, तो AI-निर्मित स्निपेट्स में छिपे हुए अनुमान देनदारियां (liabilities) बन जाते हैं। इसके बाद डिबगिंग मूल उद्देश्य की तलाश में बदल जाती है, जिससे मेंटेनेंस की लागत बढ़ जाती है।

संगठन जो व्यवसाय पूरी तरह से AI-आधारित विकास पर निर्भर रहते हैं, उन्हें भविष्य में अधिक खर्चों का जोखिम होता है: डिबगिंग, रिफैक्टरिंग और नए इंजीनियरों को शामिल करने में अधिक समय खर्च होता है जिन्हें अस्पष्ट कोड को समझना पड़ता है। जो कंपनियां अनुशासित इंजीनियरिंग प्रथाओं के साथ AI सहायता का मिश्रण करती हैं, वे दीर्घकालिक स्थिरता बनाए रखते हुए गति का लाभ उठाती हैं।

वे विवरण जिन्हें अधिकांश रिपोर्ट छोड़ देती हैं

  • सीखने पर प्रभाव: 17 प्रतिशत का अंतर एक ऐसे क्विज़ पर मापा गया था जिसने केवल सिंटैक्स की याददाश्त नहीं, बल्कि समझ का परीक्षण किया। यह सतही ज्ञान नहीं, बल्कि मेंटल मॉडल्स (mental models) के वास्तविक क्षरण को दर्शाता है।
  • कार्य पूरा करने का समय: तत्काल कोड के आकर्षण के बावजूद, अध्ययन में इस बात का कोई सांख्यिकीय रूप से महत्वपूर्ण अंतर नहीं पाया गया कि प्रत्येक समूह को असाइनमेंट पूरा करने में कितना समय लगा। गति का लाभ केवल एक भ्रम था।
  • तरीका मायने रखता है: अध्ययन ने AI के उपयोग के विभिन्न स्तरों को उजागर किया। AI पर पूर्ण निर्भरता से सीखने के सबसे खराब परिणाम मिले, जबकि चयनात्मक और जिज्ञासु प्रॉम्प्टिंग से बेहतर परिणाम मिले। "AI कोडिंग को तेज़ बनाता है" जैसे दावे करने वाली सुर्खियां अक्सर इस सूक्ष्म अंतर को नज़रअंदाज़ कर देती हैं।

प्रति-तर्क: AI बेकार नहीं है

यह अध्ययन विशिष्ट लाभों को नकारता नहीं है; यह केवल उन्हें पूरी सॉफ्टवेयर विकास प्रक्रिया पर लागू करने के विरुद्ध चेतावनी देता है। जब समस्या में सिस्टम डिज़ाइन, परफॉरमेंस ट्यूनिंग या सुरक्षा संबंधी विचार शामिल होते हैं, तो मानवीय निर्णय (human judgment) अपरिहार्य बना रहता है।

निष्कर्ष

AI आपको एक स्केटबोर्ड दे सकता है, लेकिन ब्रेक और स्टीयरिंग के ज्ञान के बिना आप सड़क मुड़ने पर दुर्घटनाग्रस्त हो जाएंगे। यह तकनीक कोड लिखने की बाधा को कम करती है, फिर भी उन इंजीनियरों की कमी बनी हुई है जो सिस्टम के बारे में तर्क कर सकें, विफलता का अनुमान लगा सकें और सॉफ्टवेयर के बढ़ने के साथ उसे जीवित रख सकें। प्रॉम्प्ट के भरोसे रहने के बजाय उस निर्णय क्षमता (judgment) में निवेश करना दीर्घकालिक लागत को नियंत्रित करने का सबसे समझदारी भरा तरीका है।