जेव्हा एखादा AI agent एखादे काम पूर्ण केल्याचा दावा करतो, तेव्हा संशय घेणे हाच एकमेव तर्कसंगत प्रतिसाद असतो. "Task completed at 14:32" असा लॉग एंट्री म्हणजे केवळ मजकुराची एक ओळ आहे. तो agent शांतपणे क्रॅश झाला असावा, रिकामे फॉर्म सबमिट केले असावेत, रिकाम्या सर्च रिझल्ट्समध्येच फिरत राहिला असावा किंवा संपूर्ण वर्कफ्लोबद्दल भ्रमित (hallucinated) झाला असावा. जर तुमच्या आर्किटेक्चरमध्ये वेगवेगळ्या मशीन्स, क्लाउड रिजन किंवा IP ॲड्रेसवर चालणारे अनेक agents असतील, तर ही समस्या वेगाने वाढते. जोपर्यंत Agent A त्याचे काम सिद्ध करू शकत नाही, तोपर्यंत Agent B कडे Agent A च्या रिपोर्टवर विश्वास ठेवण्याचे कोणतेही कारण नसते.

प्रत्येक विश्वासार्ह पडताळणी प्रणाली तीन स्तरांवर आधारित असते. पुरावा (Evidence) म्हणजे कच्चा पुरावा—जसे की स्क्रीनशॉट, API रिस्पॉन्स किंवा HTML डंप. प्रमाणपत्र (Attestation) म्हणजे एक स्वाक्षरी केलेला किंवा क्रिप्टोग्राफिक दावा, जो त्या पुराव्याला एका विशिष्ट agent आणि विशिष्ट task ID शी जोडतो. पडताळणी (Verification) ही अशी प्रक्रिया आहे जी केवळ फाईल अस्तित्वात आहे हे नाही, तर तो पुरावा खरोखर मूळ उद्दिष्ट पूर्ण करतो की नाही याची खात्री करते. Attestation शिवाय पुरावा एका कामातून दुसऱ्या कामात पुन्हा वापरला (replay) जाऊ शकतो. Verification शिवाय Attestation तुम्हाला डेटा खरा आहे हे सांगते, परंतु तो तुम्ही विचारलेल्या प्रश्नाचे उत्तर देतो की नाही हे सांगत नाही.

व्हिज्युअल पुरावा: स्क्रीनशॉट्स आणि OCR

जेव्हा एखादा agent ब्राउझर चालवतो किंवा ग्राफिकल इंटरफेससोबत संवाद साधतो, तेव्हा सर्वात सोपा पुरावा म्हणजे एक चित्र. कृती पूर्ण झाल्यावर agent पूर्ण-पेज स्क्रीनशॉट घेतो, दृश्य मजकूर काढण्यासाठी OCR चालवतो आणि प्रतिमा व काढलेले स्ट्रिंग्स (strings) दोन्ही पुरावा म्हणून सबमिट करतो.

ही पद्धत सोशल मीडिया पोस्ट, फॉर्म सबमिशन किंवा चेकआउट फ्लोसाठी योग्य आहे. समजा, एखाद्या agent ला कंपनीच्या LinkedIn पेजवर साप्ताहिक अपडेट प्रकाशित करण्याचे काम दिले आहे. स्क्रीनशॉटमध्ये सर्व्हर-रेंडर केलेला टाइमस्टॅम्प आणि URL मध्ये एम्बेड केलेला पोस्ट ID सह लाईव्ह पोस्ट दिसते. OCR त्या प्लॅटफॉर्म-विशिष्ट खुणांसोबतच नेमकी हेडलाईन आणि मुख्य मजकूर पेजवर दिसत असल्याची खात्री करू शकते.

धोका स्पष्ट आहे: स्क्रीनशॉट्स बनावट असू शकतात. एखादा हॅक झालेला (compromised) agent स्थानिक पातळीवर बनावट वेबपेज रेंडर करू शकतो, त्याचा स्क्रीनशॉट घेऊ शकतो आणि यश मिळाल्याचे घोषित करू शकतो. सुरक्षिततेचा स्तर वाढवण्यासाठी, अंदाज लावणे कठीण अशा डायनॅमिक टेक्स्ट मार्कर्सची आवश्यकता आहे. प्लॅटफॉर्मद्वारे जारी केलेला कन्फर्मेशन ID, सर्व्हरचा टाइमस्टॅम्प किंवा व्हेरिफायरने जॉब सूचनांमध्ये जोडलेला एक युनिक nonce हे सर्व अँकर (anchors) म्हणून काम करू शकतात. जर OCR आउटपुटमध्ये त्या विशिष्ट कार्याशी संबंधित अपेक्षित कन्फर्मेशन ID नसेल, तर तो पुरावा फेटाळला जातो.

तरीही, स्क्रीनशॉट्स जड असतात. ते बँडविड्थ आणि स्टोरेज वापरतात आणि जेव्हा प्लॅटफॉर्म त्यांचे लेआउट पुन्हा डिझाइन करतात तेव्हा ते निकामी ठरतात. जेव्हा UI हा एकमेव उपलब्ध पर्याय असतो तेव्हाच त्यांचा वापर करा, परंतु त्यांना केवळ एक पाया (baseline) माना, अभेद्य किल्ला (fortress) नाही.

स्वाक्षरी केलेले API रिसीट्स (Signed API Receipts)

जेव्हा agent बॅकएंड API द्वारे काम करतो, तेव्हा इमेज वगळा. स्वाक्षरी केलेला रिसीट (signed receipt) मागा.

ऑटोमेटेड पोस्ट किंवा डेटा स्क्रॅप केल्यानंतर, प्लॅटफॉर्म सहसा एक स्ट्रक्चर्ड पेलोड (structured payload) परत करतो. त्या JSON मध्ये एक ID, टाइमस्टॅम्प, स्टेटस फील्ड्स आणि कधीकधी रेट-लिमिट हेडर्स