GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Moonshot AI ने Kimi K3 चे weights आणि tooling उपलब्ध करून दिले, २.५ पट अधिक संगणकीय कार्यक्षमतेचा दावा केला

Moonshot AI ने केवळ Kimi K3 मॉडेलचे weightsच रिलीज केले नाहीत, तर उच्च-कार्यक्षमता असलेले attention kernels, MoE communication library आणि scaling scripts देखील प्रदान केले आहेत, ज्यामुळे पुरेशी हार्डवेअर क्षमता असलेल्या कोणालाही कमी खर्चात frontier-class LLM चालवणे शक्य होईल.

AI · 4 min read

MCP आता स्टेटलेस झाले आहे: सर्व्हर्स आता सामान्य HTTP लोड बॅलन्सरच्या मागे स्केल होऊ शकतात

नवीन MCP स्पेसिफिकेशनमध्ये लपवलेले सेशन आयडी (session IDs) काढून टाकले आहेत, ज्यामुळे सर्व्हर्स मानक HTTP रिव्हर्स प्रॉक्सीच्या मागे कार्य करू शकतात. दरम्यान, NVIDIA, Microsoft, IBM आणि इतर कंपन्यांनी ऑन-साइट AI एजंट तपासणीसाठी डिटेक्शन लायब्ररी, सँडबॉक्सिंग फ्रेमवर्क आणि ऑडिट लॉग्स शेअर करण्यासाठी एक कन्सोर्टियम स्थापन केले आहे.

AI · 3 min read

अँथ्रोपिकच्या क्लॉडमुळे साध्या गुगल सर्चद्वारे कोणालाही खाजगी चॅट्स शोधता येतील

रेडिट वापरकर्त्यांना असे आढळले की क्लॉडचे शेअर-चॅट यूआरएल क्रॉल केले जात होते, ज्यामुळे गुगलच्या सर्च रिझल्ट्समध्ये अल्पवयीन मुलांचे फोन नंबर, क्लिनिकल-ट्रायल डेटा, अंतर्गत कॉर्पोरेट कागदपत्रे आणि अगदी कोड स्निपेट्स असलेली खाजगी संभाषणे समोर येत होती.

AI · 5 min read

"एकाच AI विक्रेत्यावर अवलंबून राहणे तुमच्या व्यवसायाचा नाश करू शकते," सत्य नडेला म्हणाले.

नडेला यांनी इशारा दिला आहे की, प्रॉम्प्ट्स आणि अंतर्गत डेटा एकाच LLM सेवेला दिल्यास कंपनीचे ज्ञान एका अस्पष्ट 'ब्लॅक बॉक्स'मध्ये अडकते. त्यांनी "AI गेटवे"चा प्रस्ताव मांडला आहे, जो डेटा स्थानिक पातळीवर (on-premise) सुरक्षित ठेवतो आणि कंपन्यांना हवे तेव्हा मॉडेल्स बदलण्याची सुविधा देतो.

AI · 3 min read

Auto-Approve AI Agents Let Hackers Execute Code via a README File

The Friendly Fire paper demonstrated that embedding a malicious command in a README can make an unattended AI agent run arbitrary code, a flaw the authors later reproduced in their own blog-automation pipeline, exposing a hidden attack surface.

AI · 3 min read

डिक्टेशनमधील अडथळे कमी करून ते फक्त एका टॅपपर्यंत आणल्याबद्दल डेव्हलपर्सनी सँडबारच्या 'स्ट्रीम रिंग'चे कौतुक केले.

स्ट्रीम रिंगमध्ये फक्त टचपॅड आणि ब्लूटूथ लिंक ही नियंत्रणे आहेत, ज्यामुळे वापरकर्ते एकदा दाबून थेट Apple Notes सारख्या ॲप्समध्ये बोलू शकतात. फहमीच्या डेमोमध्ये असे दिसून आले की, फोन अनलॉक न करताही ही रिंग अत्यंत वेगाने आणि अचूक मजकूर तयार करते.

AI · 3 min read

इंजिनिअर्सपेक्षा कॉम्प्युटवर ४१० दशलक्ष डॉलर्सचे रिकर्सिव्ह बेट्स, ऑक्टोबरमध्ये उत्पादन आणण्याचे उद्दिष्ट

सॅन फ्रान्सिस्कोमधील या स्टार्टअपने आपल्या ६५० दशलक्ष डॉलर्सच्या निधीचा मोठा हिस्सा प्रोसेसिंग पॉवरमध्ये गुंतवला आहे. क्लाउड नोड्सना नाविन्यपूर्ण घटक मानत, ऑक्टोबरपर्यंत बाजारासाठी तयार RSI उत्पादन लाँच करण्याचे त्यांचे उद्दिष्ट आहे, जे 'कॉम्प्युट-फर्स्ट' धोरणाचे एक धाडसी परीक्षण आहे.

AI · 3 min read

Nova Suite बाजूला सारल्यानंतर, ॲमेझॉनने re:Invent मध्ये नवीन फाउंडेशन मॉडेलची झलक दाखवली

कंपनी Nova Premier, Omni, Reel आणि Canvas केवळ चालू ठेवण्याच्या ("keep the lights on") मोडमध्ये ऑनलाइन ठेवेल, परंतु त्यावर पुढील कोणतेही विकास काम होणार नाही. दरम्यान, Covariant च्या अधिग्रहणानंतर आलेले पीटर अबेल आता फ्रंटियर मॉडेल रिसर्च टीमचे नेतृत्व करत आहेत, कारण ॲमेझॉन बाह्य AI लॅब्समध्ये अब्जावधी डॉलर्स खर्च करत आहे.

AI · 3 min read

FluxA ने AgentCard लाँच केले, ज्यामुळे बॉट्स वन-युज व्हर्च्युअल कार्ड्सच्या मदतीने काहीही खरेदी करू शकतील

FluxA चे AgentCard प्रत्येक AI-चालित खरेदीसाठी एक सिंगल-युज आणि मर्यादित रकमेचा व्हर्च्युअल Visa किंवा Mastercard नंबर तयार करते आणि त्यानंतर तो लगेच रद्द करते – ज्यामुळे डेटा लीक, अति-खर्च आणि कार्ड रद्द करण्याच्या क्लिष्ट समस्या टाळता येतात.

AI · 4 min read

जिनी कोएफिशियंटमुळे शब्दशः चुका कमी होईपर्यंत एआय एजंट्सना आर्थिक नुकसानीचा धोका

जिनी कोएफिशियंट वापरकर्त्याचा खरा हेतू आणि एआय एजंटचे शब्दशः आउटपुट यामधील अंतर मोजते; हे अशा जोखमीच्या वर्तणुकीची सूचना देते ज्यामुळे अत्यंत महत्त्वाच्या क्षेत्रांमध्ये डेटा ब्रीच, आर्थिक नुकसान किंवा नियामक दंड होऊ शकतो.

AI · 3 min read

डेव्हलपर्स आता GPT-Live ला बोलून कोड टास्क देऊ शकतात, ज्यामुळे विंडो स्विचिंगची गरज कमी होईल

ChatGPT डेस्कटॉप ॲपमध्ये समाविष्ट असलेले GPT-Live, डेव्हलपर्सना "run static-analysis" किंवा "add unit tests" सारख्या कमांड्स आवाजाद्वारे देण्याची सुविधा देते, ज्यामध्ये मॉडेल कृतींची तोंडी पुष्टी करते आणि समांतर वर्कफ्लो देखील सुरू करते—हे सर्व सशुल्क सदस्यांसाठी उपलब्ध आहे.

AI · 2 min read

Auditing Agent Skills: A Threat Model

Auditing Agent Skills: A Threat Model Would you plug in a random USB drive from a stranger? You probably would not. Most people know the risk. Yet, developers do the digital equiv…

AI · 3 min read

Mozilla Bets Real-Time AI Content Will Offset Falling Search Revenue

The daily crossword is built by feeding the latest news into a large language model, which generates word-clue pairs that a mathematical solver turns into a printable grid. Mozilla says the extra stickiness could help recoup the higher compute bills and keep users from drifting to external search si

AI · 2 min read

मानवी पातळीवरील रोबोट्सना सक्षम करण्यासाठी Encord युट्यूबपेक्षा पाच पटीने मोठे डेटासेट तयार करण्याचे लक्ष्य ठेवत आहे

जर्मन स्टार्टअप Zander Labs सोबतच्या Encord च्या भागीदारीत, ऑपरेटरना EEG हेडसेट आणि फोरआर्म EMG सेन्सर्स दिले जातात, ज्याचा उद्देश युट्यूबच्या व्हिडिओ संग्रहापेक्षाही प्रचंड मोठा ट्रेनिंग सेट तयार करणे आणि रोबोटच्या चपळ हालचालींना वेगवान करणे हा आहे.

AI · 6 min read

मेट्रिक सुधारल्यानंतर RAG रिकॉल ६०% वरून ९०% पर्यंत वाढला

लेखकाला असे आढळले की, कथित "मिस" (misses) पैकी तीन चतुर्थांश माहितीमध्ये आवश्यक तथ्य प्रत्यक्षात टेस्ट स्क्रिप्टने अपेक्षित केलेल्या पेक्षा वेगळ्या पानावर उपलब्ध होते. मेट्रिक बदलून 'फॅक्ट-लेव्हल रिकॉल' केल्यामुळे ते ९०% उत्तर अचूकतेशी सुसंगत झाले.

AI · 2 min read