GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Moonshot AI ने २.८ ट्रिलियन पॅरामीटर असलेले Kimi K3 लाँच केले, पण ते घरगुती पीसीवर चालणार नाही

Moonshot AI ने २७ जुलै रोजी २.८ ट्रिलियन पॅरामीटर असलेले Kimi K3 मॉडेल सार्वजनिक डाउनलोडसाठी उपलब्ध करून दिले आहे, परंतु त्याच्या हार्डवेअर गरजांसाठी एंटरप्राइझ-ग्रेड GPU क्लस्टर्सची आवश्यकता आहे, ज्यामुळे सामान्य डेव्हलपर्सना ते सध्या स्थानिक पातळीवर चालवणे अशक्य आहे.

AI · 2 min read

LLM तर्कशक्तीचे चार एजंट्समध्ये विभाजन डेटा विश्लेषण कसे विश्वासार्ह बनवते

नवीन वर्कफ्लोमध्ये LLMsना केवळ निर्णय प्रक्रियेपुरते मर्यादित ठेवले जाते, तर डिटरमिनिस्टिक सँडबॉक्स स्क्रिप्ट्स सर्व गणना हाताळतात; यामुळे टप्प्याटप्प्याने पडताळण्यायोग्य निकाल मिळतात आणि सिंगल-प्रॉम्प्ट EDA मध्ये आढळणारी बनावट आकडेवारी मोठ्या प्रमाणात कमी होते.

AI · 3 min read

एमआयटीच्या अभ्यासात असे दिसून आले की, एआय फॅक्ट-चेकर्समुळे वापरकर्त्यांची बनावट बातम्या ओळखण्याची क्षमता कमी होते

६७ सहभागींसह चार आठवड्यांच्या प्रयोगामध्ये, एमआयटीच्या संशोधकांनी एका अचूक एआयला बातम्यांवर बायनरी निर्णय देण्यास सांगितले. जरी एआय बहुतेक वेळा बरोबर होते, तरीही त्यावर अवलंबून असलेल्या वापरकर्त्यांच्या चुकीची माहिती ओळखण्याच्या क्षमतेत एआय उपलब्ध नसताना लक्षणीय घट दिसून आली.

AI · 2 min read

Images Beat Text on Gemini: Math, Non-Latin Scripts and Tables Cost Less

Google’s Gemini counts image tokens by 768-pixel tiles, charging 258 tokens each. By keeping pictures under one tile—or using them for dense data like equations, tables, or non-Latin scripts—developers can often pay far less than sending the same information as text.

AI · 3 min read

बोगोटा समिटमध्ये AI एजंट ऑर्केस्ट्रेशन मानकीकृत करण्यासाठी AWS ने Bedrock AgentCore लाँच केले

बोगोटा समिटमध्ये, AWS ने Bedrock AgentCore चे अनावरण केले, जो एक एकीकृत प्लॅटफॉर्म आहे. हा प्लॅटफॉर्म ऑर्केस्ट्रेशन, ऑब्झर्व्हेबिलिटी आणि सेफ्टी कंट्रोल्स एकत्र आणतो, ज्यामुळे डेव्हलपर्सना कोणतीही स्वतंत्र तांत्रिक रचना न करता विशेष AI एजंट्स सहजपणे तयार करता येतील.

AI · 4 min read

Claude Code चे ७५% टर्न्स वाचण्यासाठी असतात

Claude Code चे ७५% टर्न्स वाचण्यासाठी असतात. बहुतेक लोकांना वाटते की AI कोडिंग एजंट्स आपला वेळ कोड लिहिण्यात घालवतात. नवीन डेटा दर्शवतो की हे चुकीचे आहे. Red Hat ने २१९ वास्तविक Claude Code सेशन्सचे विश्लेषण केले आहे. त...

AI · 3 min read

ETag कंडिशनल राइट्ससह व्हर्जन केलेले चेकपॉइंट्स LangGraph मधील डेटा लॉस थांबवतात

आठवडेभर होत असलेल्या मूक स्टेट लॉसनंतर, लेखकाने SQLite, रॉ ऑब्जेक्ट स्टोरेज आणि एक दोषपूर्ण हायब्रीड पद्धत वापरून पाहिली आणि शेवटी ETag-आधारित कंडिशनल राइट्ससह व्हर्जन केलेले एनव्हलप वापरले—हे एक अ‍ॅटॉमिक-अपडेट लूप आहे जे एकाच वेळी होणारे ओव्हरराईट्स थांबवते आणि विश्वासार्हता पुन्हा प्रस्थापित करते.

AI · 3 min read

Claude प्रॉम्प्ट कॅशिंगमध्ये कळत-नकळत त्रुटी येते

Claude प्रॉम्प्ट कॅशिंगमध्ये कळत-नकळत त्रुटी येते. तुमचे Claude प्रॉम्प्ट कॅशिंग कदाचित फेल होत असावे आणि तुम्हाला त्याची कल्पनाही येणार नाही. मी एका WhatsApp हँडलरमध्ये कॅश कंट्रोल जोडले आणि मी लॉग्स तपासले...

AI · 3 min read

Claude Opus 5 प्रॉम्प्ट-कॅशिंगमुळे पहिल्या कॉल नंतर चॅटबॉट टोकन खर्च ९०% ने कमी होतो

५ मिनिटे किंवा १ तासाच्या TTL साठी नवीन कॅश राइट्सची किंमत मूळ किमतीच्या १.२५x किंवा २x आहे, परंतु त्यानंतरच्या प्रत्येक हिटसाठी फक्त ०.१x शुल्क आकारले जाते. जर तुम्ही अपरिवर्तनीय संदर्भ (immutable context) आधीच लोड केला, तर सखोल संवाद केवळ एकावेळचा खर्च ठरतो.

AI · 3 min read

स्पॅम वाढवल्याशिवाय Reddit वरील नवीन वापरकर्त्यांच्या पोस्टमध्ये AI मॉडरेशनमुळे २२% वाढ

r/technology सारख्या सबरेडिट्समधील सुरुवातीच्या प्रायोगिक चाचण्यांमध्ये, Reddit च्या AI-आधारित मॉडरेशनने स्पॅम आणि छळवणुकीचे प्रमाण स्थिर ठेवत नवीन पोस्ट करणाऱ्यांची सक्रियता २२% ने वाढवली; हे मॉडेल सुरक्षिततेशी तडजोड न करता प्रवेशातील अडथळे कमी करू शकते हे यातून दिसून येते.

AI · 2 min read

स्ट्रीमिंग फिक्स Ollama RC मध्ये उपलब्ध, पण चंक फॉरमॅट्समुळे अद्याप ॲप्समध्ये समस्या येऊ शकतात

Ollama RC अपडेट: Qwen3.5 आणि स्ट्रीमिंग फिक्ससह Ollama v0.32.6 rc0 रिलीज झाले आहे. हे Apple GPU वापरकर्त्यांसाठी अपडेट्स आणि स्ट्रीमिंग समस्यांचे निराकरण घेऊन आले आहे. Apple वापरकर्त्यांसाठी नवीन वैशिष्ट्ये: MLX...

AI · 1 min read

GraphRAG + Persistent Memory Stops Chatbots From Forgetting On Tab Close

By converting retrieved text into a graph of entities and relationships, GraphRAG lets models reason across multiple documents, while a three-tier contextual memory stores short-term dialogue, long-term user facts, and selectively pruned data to survive page refreshes and new tabs.

AI · 3 min read

माझ्या एजंट ऑर्केस्ट्रेटरने प्रत्येक कामासाठी १-२ दशलक्ष डॉलर्स किमतीचे Opus टोकन्स वाया घालवले

ऑर्केस्ट्रेटरच्या सब-एजंट्सनी मूळ सेटिंग्जचा वापर केला, ज्यामुळे ते आपोआप महागड्या Opus टियरवर सेट झाले, प्रत्येक कॉलमध्ये कॅश पुन्हा लिहिली आणि रिव्ह्यूअरने मंजुरी मिळेपर्यंत ते सतत लूपमध्ये चालत राहिले; यामुळे एका साध्या कामाचा खर्च करोडो टोकन्सपर्यंत वाढला.

AI · 2 min read

Neon Polls चा कालावधी १५ मिनिटांपर्यंत वाढवल्यामुळे कंप्युट खर्चात मोठी कपात झाली

क्लायंट-साइड रिफ्रेश इंटरव्हल ३० सेकंदांवरून १५ मिनिटांपर्यंत वाढवल्यामुळे, Neon डेटाबेस पुरेसा वेळ 'आयडल' (idle) राहू शकला, ज्यामुळे तो 'स्केल टू झिरो' (scale to zero) होऊ शकला. यामुळे प्रति-सेकंद लागणारे कंप्युट चार्जेस वाचले, जे यापूर्वी Vercel कॉस्ट डॅशबोर्डवर खर्च वाढवत होते.

AI · 2 min read

GhostApproval दोषामुळे AI कोडिंग असिस्टंट्स तुमचे SSH कीज ओव्हरराईट करू शकतात

Wiz Research ने शोधून काढले आहे की, एक घातक project_settings.json symlink सहा प्रमुख AI कोडिंग टूल्सना फसवून थेट ~/.ssh/id_rsa मध्ये डेटा लिहिण्यास भाग पाडू शकते, आणि अप्रूव्हल डायलॉगमध्ये फक्त symlink चे नाव दिसते, मूळ फाईल पाथ नाही.

AI · 3 min read

Microsoft Says Execution-Ready AI Agents Need 26-60 Engineer-Weeks to Build

The new playbook outlines seven architectural pillars—authority, boundaries, schemas, failure detection, state, rollback, and auditability—that must be rebuilt from scratch before any autonomous agent can be shipped, warning that low-value tasks won’t justify the effort.

AI · 3 min read

Claude Tiering Cuts API Spend 35% and Slashes Latency to 27 s

The author built a static lookup that maps tasks by ambiguity to Haiku, Sonnet or Opus, and added a two-failure escalation rule. Over four weeks the system kept quality while driving API spend to 65% of the original and cutting median turnaround from 42 s to 27 s.

AI · 3 min read

एका सिंगल गेट काउंटरमुळे प्रोडक्शनमधील संपूर्ण दिवसाचा AI आउटेज लपला राहिला

माझे AI फीचर एक दिवस ठप्प होते. मेट्रिक्सनुसार ते व्यवस्थित काम करत होते. काल, माझ्या ड्रोन सिस्टमने चार AI स्पष्टीकरणे नोंदवली. एका सेफ्टी गेटने त्या चारही नाकारल्या. मला त्याबद्दल समाधान वाटले...

AI · 2 min read

हर्मिस एजंट AI टूलचे एक्झिक्यूशन ऑन-प्रिमाइस ठेवून डेटा-गळतीचे धोके कमी करते

हर्मिस एजंट डेव्हलपर्सना शेल कमांड्स, फाईल I/O आणि कस्टम सर्व्हिसेस जोडण्याची सुविधा देऊन चॅटबॉट्स आणि प्रोग्रामेबल हेल्पर्समधील दुवा साधते, आणि हे सर्व त्यांच्या स्वतःच्या हार्डवेअरवर सेशन्समध्ये कॉन्टेक्स्ट साठवत करते.

AI · 3 min read

First Demo Satellite Set for Late 2027 to Deliver Up to 1 Tbps Downlink

EON’s 20-satellite low-Earth orbit constellation will use high-powered lasers and weather-diverse ground stations to deliver terabit-scale links on high-value routes like France-Australia, aiming to give AI-heavy customers dedicated, low-latency capacity.

AI · 4 min read