ஒரு புதிய WhatsApp அடிப்படையிலான RAG (retrieval-augmented generation) உதவியாளர், ஒவ்வொரு பதிலையும் JSON-encoded மேற்கோளுடன் (citation) ஆதரிக்க வேண்டும் என்று கட்டாயப்படுத்துவதன் மூலம் தவறான தகவல்களைத் (hallucinating) தருவதை நிறுத்தியுள்ளது. மாடலால் ஒரு குறிப்பிட்ட பகுதியை (chunk) சுட்டிக்காட்ட முடியாதபோது, அது “அதற்குப் பதிலளிக்க என்னிடம் போதுமான தகவல்கள் இல்லை” என்று பதிலளிக்கிறது. இதன் மூலம், நம்பிக்கையுடன் பொய் சொல்லும் ஒரு அமைப்பானது, நம்பகமான “எனக்குத் தெரியாது” என்று சொல்லும் அமைப்பாக மாறியுள்ளது.

RAG-இல் நம்பிக்கை ஏன் முக்கியமானது

RAG குறித்த பெரும்பாலான பயிற்சிகள் (tutorials) மீட்டெடுப்பிலேயே (retrieval) அதிக கவனம் செலுத்துகின்றன—embeddings தேர்ந்தெடுப்பது, ஆவணங்களைச் சிறு துண்டுகளாக (chunks) பிரிப்பது, முடிவுகளை மறுவரிசைப்படுத்துவது (re-ranking) போன்றவை இதில் அடங்கும். பொருத்தமான உரை கண்டறியப்பட்ட பிறகு என்ன நடக்கிறது என்பதை அவை விட்டுவிடுகின்றன. மீட்டெடுக்கப்பட்ட சூழல் (context) உண்மையில் ஆதரிக்காத ஒரு உறுதியான பதிலைத் துணைவி வழங்கும் போது, பயனர்கள் அதன் மீதான நம்பிக்கையை இழக்கிறார்கள்.

நம்பிக்கையின் இடைவெளி

PostgreSQL மற்றும் pgvector extension கொண்டு உருவாக்கப்பட்ட ஒரு முன்மாதிரியில் (prototype), மீட்டெடுப்பு வழிமுறை (retrieval pipeline) எளிமையாக இருந்தது. ஆனால் உண்மையான பயன்பாட்டில் (production) சவால் உருவானது: மீட்டெடுக்கப்பட்ட சிறு பகுதி (snippet) தேவையான தகவல்களைக் கொண்டிருக்காவிட்டாலும், மொழி மாதிரி (language model) மிகவும் உறுதியாகப் பேசியது. ஒரு டெமோவில் இந்தப் பிரச்சனையை மறைக்க முடிந்தாலும், உண்மையான பயனர்கள், நம்பிக்கையுடன் பேசுவதற்கும் சரியாகப் பேசுவதற்கும் இடையிலான இடைவெளியை வெளிச்சம் போட்டுக் காட்டினர்.

JSON மூலம் மேற்கோள்களைக் கட்டாயப்படுத்துதல்

“உங்களிடம் சூழல் (context) இருந்தால் மட்டுமே பதிலளிக்கவும்” போன்ற தூண்டுதல்களைக் (prompts) கொண்டு மாடலை வற்புறுத்துவதற்குப் பதிலாக, ஆசிரியர் வெளியீட்டு வடிவத்தை (output format) மாற்றினார். இப்போது ஒவ்வொரு கூற்றும் (claim) அதை ஆதரிக்கும் சரியான பகுதியை (chunk) ஒரு குறிப்புடன் (reference) கொண்டிருக்க வேண்டும் என்று இந்த அமைப்பு ஒரு JSON object-ஐக் கோருகிறது. மாடலால் ஒரு மேற்கோட்டை (citation) இணைக்க முடியாவிட்டால், அந்தப் பதில் நிராகரிக்கப்பட்டு, பயனர் தெளிவான “எனக்குத் தெரியாது” என்ற செய்தியைப் பார்ப்பார்.

இந்தத் தடையானது இயற்கை மொழி வழி அறிவுறுத்தல்களில் (natural-language instructions) இருந்து ஸ்கீமா சரிபார்ப்பு (schema validation) முறைக்கு மாற்றப்பட்டது. மாடல் இன்னும் உரையை உருவாக்குகிறது, ஆனால் அந்த JSON பயனாளிக்குச் சென்றடைவதற்கு முன், அதைச் சுற்றியுள்ள குறியீடு (code) அது தேவையான கட்டமைப்பைப் பின்பற்றுகிறதா என்பதைச் சரிபார்க்கிறது.

என்ன மாறியது

  • துண்டாக்குதல் (Chunking) மிகவும் எச்சரிக்கையாக மாறியது. தெளிவற்ற அல்லது மிக விரிவான துண்டுகள் (chunks) இப்போது மேற்கோள்கள் இல்லாத கூற்றுகளை உருவாக்குகின்றன, இது “எனக்குத் தெரியாது” என்ற மாற்றுப் பதிலைத் (fallback) தூண்டுகிறது.
  • System prompt சுருங்கியது. மாடலின் நடத்தையைக் கட்டுப்படுத்த முயன்ற கடினமான தூண்டுதலுக்குப் பதிலாக, ஒரு சிறிய அறிவுறுத்தல் தொகுப்பு பயன்படுத்தப்படுகிறது, இது ஸ்கீமாவையே முக்கியப் பணியைச் செய்ய அனுமதிக்கிறது.
  • தோல்விகள் வெளிப்படையாகத் தெரிகின்றன. மீட்டெடுப்பு பொருத்தமற்ற தகவல்களைத் தரும்போது, உதவியாளர் இனி நம்பிக்கையான ஆனால் தவறான பதிலைக் கொண்டு பிழையை மறைப்பதில்லை; அது தனது நிச்சயமற்ற தன்மையை வெளிப்படையாக ஒப்புக்கொள்கிறது.

சுருக்கம் (Takeaway): RAG உதவியாளர்களுக்கு, ஒவ்வொரு கூற்றும் மீட்டெடுக்கப்பட்ட ஆதாரத்துடன் தொடர்புபடுத்தப்படலாம் என்பதை உறுதிப்படுத்துவது, மீட்டெடுப்புப் படிநிலையை மட்டும் மெருகேற்றுவதை விட பயனரின் நம்பிக்கையை மிகவும் நம்பகமான முறையில் உருவாக்குகிறது. விடுபட்ட மேற்கோள்களை ஒரு தெளிவான “எனக்குத் தெரியாது” என மாற்றுவதன் மூலம், டெவலப்பர்கள் பதில்களைத் தயாரிப்பதற்குப் பதிலாக, அமைப்பின் வரம்புகளை ஒப்புக்கொள்ள அனுமதிக்கிறார்கள்.