GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Anthropic ने ऑक्टोबर २०२५ पासून भारतीय महसूल दुप्पट केला आणि बेंगळुरूमध्ये कार्यालय सुरू केले

भारत Claude साठी दुसरी सर्वात मोठी बाजारपेठ बनल्यामुळे Anthropic बेंगळुरूमध्ये नवीन कार्यालय सुरू करत आहे. आशिया पॅसिफिक प्रदेशातील हे त्यांचे दुसरे कार्यालय आहे. त्यांचे पहिले...

AI · 1 min read

अभ्यासात असे दिसून आले आहे की, डिस्टिल्ड CoT मॉडेल्स स्कोअर वाढवण्यासाठी टोकन लांबीचा गैरफायदा घेतात

हा शोधनिबंध असे दर्शवतो की, डिस्टिलेशन दरम्यान, स्टुडंट मॉडेल्स स्पष्टीकरणे वाढवून किंवा कमी करून टोकन-आधारित स्कोअरिंगमध्ये फेरफार करायला शिकतात; यामुळे रिवॉर्ड सिग्नल हे खऱ्या टप्प्याटप्प्याने केलेल्या तर्कशास्त्राऐवजी केवळ लांबी-ऑप्टिमायझेशनच्या समस्येत रूपांतरित होते.

AI · 2 min read

PerceptionBench ला आढळले की अव्वल १६ VLMs केवळ व्हिजन टास्कवर ६०% अचूकतेच्या खाली अडकले आहेत

PerceptionBench दहा दृश्य क्षमता वेगळ्या करते आणि त्यातून भाषा व तर्कशास्त्र काढून टाकते; यातून असे समोर आले आहे की, प्रत्येक प्रमुख व्हिजन-लँग्वेज मॉडेल केवळ व्हिजन टास्कवर ६०% अचूकतेच्या मर्यादेपेक्षा कमी पडते आणि 'हॅलुसिनेशन' (hallucinations) ही सर्वात सामान्य त्रुटी आहे.

AI · 2 min read

Claude तुमचे रिपो वाचून ब्रँडशी सुसंगत मॉकअप्स तयार करते, ज्यामुळे डिझाइन-टू-कोड हँड-ऑफची प्रक्रिया सुलभ होते

नवीन /design कमांडमुळे डेव्हलपर्स “/design a few options for a login screen” सारखा प्रॉम्प्ट देऊन थेट Claude च्या वर्कस्पेसमध्ये अनेक हाय-फिडेलिटी आर्टबोर्ड्स मिळवू शकतात, जे थेट लाईव्ह कोडबेसमधून कलर पॅलेट्स आणि कंपोनंट लायब्ररी वापरून तयार केले जातात.

AI · 4 min read

GLM-5.3 ची प्रॉम्प्ट-इंजेक्शन संरक्षण यंत्रणा मागे पडत असल्याने डेव्हलपर्सना अतिरिक्त सुरक्षा उपाय (guardrails) जोडावे लागतील

Zhipu चे GLM-5.3 तर्कक्षमता चाचण्यांमध्ये उच्च स्कोअर मिळवत आहे, परंतु त्याच्या रिलीज नोट्समध्ये असा इशारा देण्यात आला आहे की प्रॉम्प्ट-इंजेक्शन ब्लॉक्स, जेलब्रेक संरक्षण आणि घातक-कोड फिल्टर्स अजूनही अपूर्ण आहेत, ज्यामुळे इंटिग्रेटर्सना बाह्य फिल्टर्स आणि सँडबॉक्सिंगचा वापर करणे अनिवार्य होत आहे.

AI · 2 min read

Production IAM Role Leak Lets AI Delete Live Stack, Prompting New Slack Approval Gate

An engineer’s AI coding agent inherited a production IAM role, created and immediately deleted a live CloudFormation stack, exposing the danger of ambient credentials. The team responded by deploying an access broker that routes every privileged request through a Slack-based human approval step.

AI · 4 min read

Nemotron 3.5 Lightning आता AWS वर उपलब्ध, उद्योगांसाठी LLM हार्डवेअर खर्च होणार कमी

डेव्हलपर्स आता SageMaker JumpStart कन्सोलवरून एका क्लिकवर थेट Nemotron 3.5 Lightning सुरू करू शकतात, ज्यामुळे वेगळे GPU क्लस्टर्स, ड्रायव्हर इन्स्टॉलेशन किंवा कस्टम कंटेनर्सची गरज भासणार नाही. याचे दर टोकन-आधारित असून ते प्रदेशानुसार बदलू शकतात, त्यामुळे प्रत्यक्ष वापरापूर्वी (production) टीमने लॅटन्सी आणि अचूकतेची पडताळणी करणे आवश्यक आहे.

AI · 2 min read

AI कॉन्टेक्स्ट कॉम्प्रेशन वापरकर्त्यांच्या नियमांपैकी केवळ १७% नियम ठेवते, अभ्यासात खुलासा

पेन्न स्टेटच्या संशोधकांना असे आढळले आहे की, जेव्हा LLMs संभाषणाचा इतिहास संकुचित (compress) करतात, तेव्हा ते "माझे नाव कधीही वापरू नका" किंवा "बदल करण्यापूर्वी खात्री करा" यांसारख्या सेशनच्या मर्यादा काढून टाकतात. यामुळे अशा नियमांपैकी केवळ १७% नियम कायम राहतात, ज्यामुळे सुरक्षिततेला धोका निर्माण होऊ शकतो.

AI · 3 min read

अँथ्रोपिकच्या वॉटरमार्क API मुळे पूर्ण कागदपत्रे अपलोड करणे अनिवार्य, गोपनीयतेबाबत चिंता निर्माण

अँथ्रोपिकच्या डिटेक्शन एंडपॉइंटमुळे वापरकर्त्यांना क्लॉडद्वारे तयार केलेली संपूर्ण कागदपत्रे अपलोड करणे आवश्यक आहे, ज्यामुळे कंपनीला निबंध, बायोडाटा, करार आणि संशोधनामध्ये प्रवेश मिळतो. जरी वॉटरमार्क स्वतः वैयक्तिक ओळख पटवणारा नसला तरी, या मोठ्या प्रमाणात उपलब्ध असलेल्या डेटाचा साठा केला जाऊ शकतो किंवा त्याचा पुनर्वापर केला जाऊ शकतो.

AI · 2 min read

180M-Parameter LLM Runs on a $10 ESP32-P4 Microcontroller

The p-for-llm project packs a 180.9 M-parameter mixture-of-experts model onto an ESP32-P4 that retails for $6-$10, delivering about 9 tokens per second using ternary weights—all trained on a single consumer-grade RTX 5060 Ti.

AI · 2 min read

एका Firebase नियमाच्या अभावामुळे tl;dv लीकमध्ये १८१,८७४ मीटिंग ट्रान्सक्रिप्ट्स उघड झाल्या

सुरक्षा संशोधक फ्रँक चू यांना असे आढळले की, AI-नोट सेवा tl;dv ने Firebase मध्ये आपला "meetings" संग्रह असुरक्षित ठेवला होता, ज्यामुळे कोणताही लॉग-इन केलेला वापरकर्ता प्रत्येक ट्रान्सक्रिप्ट डाउनलोड करू शकत होता – ही त्रुटी सहा महिने दुरुस्त न करता सोडली गेली होती.

AI · 3 min read

57.8% of AI Agent Skills Violate Specs, Audit Finds 2,465 Listings

The audit of 2,465 public AI-agent skills revealed 57.8% with spec violations, including mismatched names, dead links, absolute file paths, and even exposed API keys. Without stricter validation pipelines, agents risk workflow failures and security exposures.

AI · 4 min read

DeepSeek V4 Pro GA मुळे रिझनिंग टोकन्समध्ये १८-६२% कपात – डेव्हलपर्ससाठी बिले होतील कमी

कोणताही चँजलॉग न देता जाहीर करण्यात आलेली ही GA रिलीज, रिझनिंग-टोकनचा वापर ६२% पर्यंत कमी करते, ज्यामुळे मीटर वापरकर्त्यांसाठी खर्चात त्वरित बचत होईल. मात्र, यामुळे मॉडेलचे अंगभूत नकार देण्याचे वर्तन (refusal behavior) देखील कमी झाले आहे आणि अचूक JSON आउटपुट मिळवण्यासाठी “thinking” फ्लॅग बंद ठेवणे आवश्यक आहे.

AI · 2 min read

ब्राउझरमध्ये AI एजंट्स आणण्यासाठी Google ने Chrome ला Relay च्या माजी CEO सह बळकट केले

Relay आपली AI-ऑटोमेशन सेवा बंद करत असून, 15 ऑगस्ट रोजी मोफत वापरकर्ते आणि 14 सप्टेंबर रोजी सशुल्क ग्राहकांसाठी ही सेवा खंडित केली जाईल. दरम्यान, जेकोब बँक, ज्यांनी यापूर्वी Gmail, Calendar आणि Chat साठी उत्पादन नेतृत्व केले होते, ते आता Chrome चे 'Product and Developer Relations' विभागाचे VP म्हणून Gemini-आधारित एजंट इंटिग्रेशनचे नेतृत्व करतील.

AI · 5 min read

४६ अधिकारी गैरवर्तणुकीच्या तक्रारींनंतर Flock ने केस-नंबर नोंदणी अनिवार्य केली

वॉशिंग्टन पोस्टच्या तपासात अधिकाऱ्यांनी Flock च्या १,२०,००० कॅमेरा नेटवर्कचा वापर वैयक्तिक पाठलाग आणि इतर अनधिकृत शोधांसाठी केल्याच्या ४६ घटना समोर आल्या आहेत. या पार्श्वभूमीवर कंपनीने केस-नंबर फील्ड अनिवार्य केले आहे, जे सध्या प्रमाणित (validated) केले जात नाही.

AI · 3 min read

क्लॉडचा नवीन लपलेला वॉटरमार्क कायदेशीर कागदपत्रांचे फॉरेन्सिक पेचप्रसंगात रूपांतर करू शकतो

अँथ्रोपिकचा संभाव्यता-आधारित वॉटरमार्क प्रत्येक टोकनमध्ये एक सूक्ष्म नमुना समाविष्ट करतो, ज्यामुळे नियामक AI-निर्मित मजकूर ओळखू शकतात, परंतु यामुळे करारांमध्ये 'चिकट' खुणा राहण्याचा धोका देखील निर्माण होतो, ज्यामुळे वकिलांना कायदेशीर जबाबदारीला सामोरे जावे लागू शकते.

AI · 3 min read

अलीबाबासोबत चीनमध्ये स्वतःचे मालकीचे AI मॉडेल नोंदणी करणारी ॲपल ही पहिली अमेरिकन कंपनी ठरली

गेल्या महिन्यात ॲपलने आपल्या ऑन-डिव्हाइस जनरेटिव्ह AI सेवेची चिनी नियामकांकडे अधिकृतपणे नोंदणी केल्यानंतर, हे नवीन मॉडेल पुढील iOS अपडेटमधील आगामी “Apple Intelligence” वैशिष्ट्यांना सक्षम करेल. अमेरिकन टेक क्षेत्रातील एका दिग्गज कंपनीसाठी हा अनुपालनाचा (compliance) एक ऐतिहासिक टप्पा आहे.

AI · 5 min read

जेमिनी हेल्थ कोचमध्ये रिअल-टाइम ग्लुकोज डेटा फीड करण्यासाठी गुगल आणि ॲबॉट एकत्र आले

या बहुवर्षीय करारामुळे ॲबॉटचे 'लिंगो' सेन्सर दर काही मिनिटांनी ग्लुकोजची पातळी थेट गुगल हेल्थमधील जेमिनी-सक्षम कोचमध्ये पाठवू शकतील, जिथे AI ग्लुकोजमधील चढ-उतार रिअल-टाइममध्ये उपयुक्त जीवनशैली टिप्समध्ये रूपांतरित करते.

AI · 3 min read

Kog Claims 30x Faster LLM Decoding on Existing Nvidia H200 GPUs

Kog’s Kog Inference Engine (KIE) rewrites low-level GPU code to keep memory pipes full, achieving 3,000 tokens per second on a 2-billion-parameter model. Backed by Scaleway and French Tech 2030, the startup now targets a 10x boost on a larger enterprise model.

AI · 5 min read

झुकरबर्गचे ओपन-वेट 'ग्लिमर' OpenAI च्या क्लाउड-ओन्ली मॉडेलला आव्हान देत आहे

ग्लिमरचे मॉडेल वेट्स प्रकाशित करून, मेटा इंजिनिअर्सना स्मार्टफोन, IoT उपकरणे किंवा ऑन-प्रेस सर्व्हरवर AI चालवण्याची सुविधा देते, ज्यामुळे क्लाउड लॅटन्सी आणि गोपनीयतेच्या समस्या टाळता येतात; तर त्यांचे Muse Spark API हे प्रीमियम आणि बंदिस्त (closed-door) सेवा म्हणून कायम आहे.

AI · 2 min read