GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Vercel AI SDK 7 टूल्सना केवळ त्यांच्या घोषित केलेल्या सिक्रेट्सपुरते मर्यादित करते

आता SDK मध्ये प्रत्येक टूलसाठी Zod-आधारित कॉन्टेक्स्ट स्कीमा प्रदान करणे अनिवार्य आहे, आणि रनटाइममध्ये Vercel हे सुनिश्चित करते की केवळ घोषित केलेली फील्ड्सच पास केली जात आहेत; कोणत्याही अतिरिक्त किंवा गहाळ की आढळल्यास एक्झिक्यूशन थांबवले जाते.

AI · 3 min read

महिना ५-१० दशलक्ष टोकन्स वापरल्यानंतरच सेल्फ-होस्टिंग API च्या खर्चापेक्षा फायदेशीर ठरते

स्वतःचे LLM चालवण्याचा खरा खर्च विरुद्ध API. ओपन वेट्स मोफत आहेत, पण ते चालवणे मोफत नाही. अनेक लोकांना वाटते की ओपन मॉडेल सेल्फ-होस्ट केल्याने पैशांची बचत होते. पण ही एक चूक आहे. तुम्हाला पाहावे लागेल...

AI · 3 min read

Deep Interaction मुळे LLM दुरुस्तीचे यश २५% ने वाढले, तर टोकन्सचा वापर ४०% ने घटला

मॉडेलचे आउटपुट हे एडिट करण्यायोग्य मजकूर मानून, Deep Interaction डेव्हलपर्सना चुकीचा तर्क (reasoning step) अचूकपणे शोधण्यास, तो पुन्हा लिहिण्यास आणि एक संक्षिप्त प्रॉम्प्ट पुन्हा फीड करण्यास मदत करते—ज्यामुळे STEM बेंचमार्कवर दुरुस्तीच्या दरात २५% वाढ आणि टोकन वापरामध्ये ४०% घट झाली आहे.

AI · 2 min read

AI ऑन-कॉल एजंटने एका आठवड्यात सरासरी समस्या निवारण वेळ ४५ मिनिटांवरून २० मिनिटांपर्यंत कमी केला

मी एका आठवड्यासाठी माझ्या क्लाउड ऑप्स (Cloud Ops) चालवण्यासाठी एका AI एजंटला संधी दिली. मी माझ्या क्लाउड ऑपरेशन्स चालवण्यासाठी एका AI एजंटला सात दिवस दिले. हे एक वास्तविक वातावरण होते, डेमो नाही. मी त्याला माझ्या मॉनिटरिंगचा रीड ॲक्सेस दिला...

AI · 4 min read

AWS एजंट टूलकिटमुळे OpenSearch सेटअपचा वेळ कमी होतो, पण NextGen वेक्टर कॉन्फिगरेशनमध्ये अडखळते

नवीन amazon-opensearch-service स्किलमुळे पॉलिसी सिक्वेन्सिंग आणि इन्स्टन्स सायझिंगचा वेग वाढतो, परंतु Serverless NextGen वर वेक्टर सर्च कॉन्फिगर करण्यास सांगितल्यावर ते डिफॉल्टनुसार क्लासिक FAISS सेटिंग्ज वापरते, ज्यामुळे डिप्लॉयमेंटमध्ये अपयश येते.

AI · 4 min read

Inkling (975B) सकाळी लाँच झाले, तर सोळा तासांनंतर Moonshot AI ने 2.8T Kimi K3 लाँच केले

या दोन लाँचमुळे ओपन-वेट मॉडेल्स आता उपेक्षित प्रकल्पांकडून मुख्य प्रवाहातील AI कडे वळत आहेत, ज्यामुळे कंपन्यांना Apache 2.0 अंतर्गत स्वतःच्या सर्व्हरवर (on-premises) अवाढव्य मॉडेल्स चालवण्याचा पर्याय मिळत आहे आणि कोडिंगच्या कामांमध्ये ते क्लोज्ड-सोर्स मॉडेल्सच्या कामगिरीशी स्पर्धा करण्यास सक्षम आहेत.

AI · 3 min read

नवीन वर्कफ्लो-ड्रिफ्ट डिटेक्टर ॲप अपडेट्सनंतर बॉट्सना अयशस्वी होण्यापासून रोखतो

हे फ्रेमवर्क UI, API, डेटा, परवानगी आणि पॉलिसी अशा पाच ड्रिफ्ट श्रेणी परिभाषित करते आणि स्वायत्त एजंट कार्यान्वित होण्यापूर्वी विसंगती शोधण्यासाठी हलके कॉन्ट्रॅक्ट मॅप आणि प्री-फ्लाइट स्कॅन्सचा वापर करते, ज्यामुळे 'सायलेंट फेल्युअर' आणि खर्चिक पुनरावृत्ती टाळता येते.

AI · 4 min read

Anthropic ने जोडले MCP कनेक्टर्स, ज्यामुळे Claude कोड स्निपेट्सचे रूपांतर थेट कार्यरत ॲप्समध्ये होईल

Model Context Protocol (MCP) कनेक्टर्समुळे, Claude द्वारे तयार केलेला कोड आता थेट चॅटमधून डेटाबेस, क्लाउड सेवा किंवा Slack वापरू शकतो. यामुळे कॉपी-पेस्ट करण्याची प्रक्रिया संपते आणि डेव्हलपर्सना वास्तविक डेटासह त्वरित चाचणी करणे शक्य होते.

AI · 2 min read

AI Agent Made 1,858 Tool Calls in a Day Yet Delivered Nothing

A missing verification step let the agent skip its ‘do’ phase, so it spent a full day drafting 1,858 internal reflections without ever invoking a real tool, exposing a self-loop trap that can cripple any tool-driven assistant.

AI · 2 min read

हिडन-टॅब थ्रॉटलिंगमुळे क्रोम AI टेस्ट एजंट्सपासून कॅनव्हासमधील त्रुटी लपवू शकते

AI एजंटला स्वच्छ JavaScript रिझल्ट्स आणि स्क्रीनशॉट दिसले, परंतु क्रोमच्या हिडन-टॅब थ्रॉटलिंगमुळे requestAnimationFrame कॉलबॅक थांबले, ज्यामुळे कॅनव्हास पेंट झाला नाही. दृश्यमान टॅबमध्ये टेस्ट चालवणे किंवा 'पिक्सेल-नॉन-एम्प्टी' चेक जोडणे याने ही चुकीची पास (false pass) स्थिती सुधारता येते.

AI · 3 min read

Claude Code 2.1.212: AI खर्चाचा विस्फोट रोखण्यासाठी सब-एजंट्सची संख्या २०० वर मर्यादित केली

या अपडेटमध्ये दोन एन्व्हायरनमेंट-व्हेरिएबल मर्यादा (caps) आणल्या आहेत – एक सब-एजंट निर्मितीसाठी आणि दुसरी वेब-सर्च कॉल्ससाठी. या दोन्ही मर्यादा प्रति सेशन २०० वर सेट केल्या आहेत. तसेच, लांब MCP कॉल्ससाठी २ मिनिटांचा ऑटो-बॅकग्राउंड नियम देखील देण्यात आला आहे, ज्यामुळे टीम्सना अनियंत्रित खर्च नियंत्रित करण्यासाठी एक ठोस उपाय मिळेल.

AI · 4 min read

Public GitHub Issue Lets AI Bot Leak Private Repo Code in One Click

Noma Labs demonstrated that an attacker can post a crafted issue in a public repo, trigger a CI-linked AI agent with read rights to private repos, and have the bot dump those files back to the issue—all without stealing credentials or exploiting GitHub itself.

AI · 2 min read

X402 ला मानकांचे घर मिळाले आहे, परंतु पेमेंट अधिकाराची पडताळणी करण्यासाठी कोणतीही टेस्ट सूट नाही

Visa, Mastercard, Stripe आणि Google यांच्या पाठिंब्याने स्थापन झालेल्या लिनक्स फाऊंडेशनच्या नवीन X402 फाऊंडेशनने AI-एजंट पेमेंटसाठी मेसेज फॉरमॅट परिभाषित केला आहे, परंतु कोणतीही कन्फर्मन्स सूट, सुरक्षा प्रोफाइल किंवा प्रमाणीकरण प्रक्रिया वगळली आहे, ज्यामुळे अधिकाराचा दावा अपरीक्षित राहिला आहे.

AI · 3 min read

नवीन १६३ प्रकरणांचा बेंचमार्क K8sGPT ला कृती करण्यापूर्वी अनिश्चितता मान्य करण्यास भाग पाडतो

१६३ लेबल केलेल्या घटनांवर आधारित हा बेंचमार्क केवळ निदानापलीकडे जाऊन, AI सहाय्यक अनिश्चितता ओळखू शकतात आणि जाणीवपूर्वक निर्णय घेण्यास नकार देऊ शकतात का, हे तपासतो; ज्यामुळे LLM चा आत्मविश्वास वाढत असताना निर्माण होणारी एक महत्त्वाची सुरक्षा त्रुटी अधोरेखित होते.

AI · 2 min read

Automated Glitch Clustering Lets LIGO Spot Fainter Gravitational Waves

By repurposing models trained on unrelated image datasets, LIGO’s new system not only classifies known glitch families with near-perfect precision but also clusters novel anomalies, freeing scientists to focus on astrophysics instead of manual data cleaning.

AI · 2 min read

Anthropic ने Claude ला 1Password चा प्रवेश दिला, ज्यामुळे AI आता ॲप्समध्ये स्वायत्तपणे लॉग इन करू शकेल

Google च्या Gemini Notebook मध्ये आता त्वरित AI क्वेरीसाठी PDFs, Docs आणि इतर फाइल्स इंडेक्स केल्या जातात, तर Anthropic च्या Claude कडे सेवांमध्ये साइन इन करण्यासाठी 1Password मधून क्रेडेंशियल्स मिळवण्याची क्षमता आहे; तसेच, एका संयुक्त स्पेसिफिकेशनचा उद्देश एजंट्सना कस्टम कोडशिवाय API शोधणे आणि वापरणे सक्षम करणे हा आहे.

AI · 2 min read

AWS Continuum कोडमधील त्रुटी रिअल-टाइममध्ये सुधारण्यासाठी 'रिझनिंग एजंट्स' तैनात करत आहे

AWS Continuum चे AI एजंट्स व्हर्जन-कंट्रोल रिपॉझिटरीजवर सतत देखरेख ठेवतात, सुधारणा सुचवतात आणि डेव्हलपर्सच्या IDEs किंवा CI पाइपलाइन्समध्ये थेट पॅचेस देखील लागू करू शकतात, ज्यामुळे सप्लाय-चेन हल्ल्यांची शक्यता लक्षणीयरीत्या कमी होते.

AI · 3 min read

गुगलच्या नवीन TPU करारासह इंटेलने AI पॅकेजिंगवरील TSMC चे वर्चस्व मोडीत काढले

या बदलामुळे गुगलला लेआउटपासून टेस्टिंगपर्यंत संपूर्ण चिप स्टॅक पुन्हा डिझाइन करण्यास भाग पाडले आहे आणि इंटेलच्या उत्पादन क्षमतेची (yield capabilities) बारकाईने तपासणी होत आहे. यश मिळाल्यास AI-चिप पुरवठा साखळीमध्ये विविधता येऊ शकते; मात्र, कोणत्याही अडथळ्यामुळे शिपमेंटला विलंब होऊ शकतो आणि TSMC ला पुन्हा आपले वर्चस्व मिळवण्याची संधी मिळू शकते.

AI · 2 min read

क्रुसेड आणि लान्सियम स्ट्रँडेड गॅस पॉड्सचा वापर करून १ GW टेक्सस AI कॅम्पस कार्यान्वित करत आहेत

कारखान्यांमध्ये तयार केलेले आणि पूर्ण युनिट्स म्हणून पाठवलेले हे मॉड्युलर पॉड्स काही आठवड्यांत जोडले जाऊ शकतात, तर लान्सियमचे सॉफ्टवेअर एका व्हर्च्युअल बॅटरीप्रमाणे काम करते, जे मागणी संतुलित करते आणि स्थानिक ERCOT ग्रिड स्थिर ठेवण्यासाठी अतिरिक्त अक्षय ऊर्जा किंवा वायू निर्मितीचा वापर करते.

AI · 3 min read