GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

केवळ रेडॅक्शन-आधारित सुरक्षा अपयशी ठरते: तीन डेटा स्ट्रीम्समुळे AI कोपायलट्स रेकॉर्ड्स लीक कसे होऊ शकतात

या विश्लेषणानुसार असे दिसून येते की केवळ मॉडेलच्या आउटपुटचे संरक्षण करणे पुरेसे नाही – रॉ क्वेरीज, CRM फेचेस आणि अंतिम उत्तर या प्रत्येकासाठी स्वतंत्र सुरक्षा उपाय आवश्यक आहेत; अन्यथा, मॉडेल-आउटपुटमध्ये कोणताही बिघाड न दिसताही एखादा व्यवसाय नावे, ईमेल आणि आयडी उघड करू शकतो.

AI · 3 min read

विगेट्स आयफ्रेम्समध्ये (Iframes) असल्याने AI सहाय्यक ॲमस्टरडाममधील २०० रेस्टॉरंट बुकिंग करण्यात अपयशी ठरले

जुलैमध्ये ॲमस्टरडाममधील २०० खाद्यपदार्थांच्या ठिकाणांच्या केलेल्या चाचणीतून असे दिसून आले की, 'सेम-ओरिजिन पॉलिसी' आयसोलेशनमुळे AI एजंट्स बुकिंग बटणवर अडकतात, तर १६३ पैकी केवळ नऊ साइट्स मशीन-रीडेबल रिझर्व्हेशन डेटा उपलब्ध करून देतात, ज्यामुळे एजंट्सना केवळ अंदाज लावावा लागतो.

AI · 3 min read

LLM-द्वारे तयार केलेले टेस्ट सूट्स १००% कव्हरेज गाठतात, पण म्यूटेशन टेस्टमध्ये केवळ ४% गुण मिळवतात

या अभ्यासात HumanEval-Java बेंचमार्कवर LLM-द्वारे तयार केलेल्या टेस्ट सूट्सचे मूल्यमापन करण्यात आले. असे दिसून आले की, त्यांनी प्रत्येक लाईन आणि ब्रांच तपासल्या तरीही, मुद्दाम टाकलेल्या केवळ काही बग्सचाच शोध घेता आला, ज्यामुळे म्यूटेशन स्कोअर केवळ ४% इतका राहिला.

AI · 2 min read

Spring AI मुळे आता जावा टीम्स केवळ एका कॉन्फिगरेशन बदलाद्वारे Spring Boot मध्ये LLMs समाविष्ट करू शकतील

Spring AI मध्ये ChatModel, EmbeddingModel आणि VectorStore सारखी abstractions सादर करण्यात आली आहेत, जी Spring MVC, Data आणि Cloud सोबत सुसंगत आहेत. यामुळे सर्व विद्यमान DI आणि AOP पॅटर्न कायम ठेवून, केवळ एक प्रॉपर्टी बदलून टीम्स प्रोव्हायडर्स सहजपणे बदलू शकतात.

AI · 3 min read

पांढऱ्या रंगाच्या मजकुरात लपलेल्या 'Self-Replicating AI Worm' मुळे Microsoft Copilot वर हल्ला

सुरक्षा संशोधक Håkon Måløy यांनी दाखवून दिले की, .docx फाईलमध्ये अदृश्य पांढऱ्या रंगाचा मजकूर समाविष्ट केल्यामुळे Copilot for Word आपोआप कमांड्स कार्यान्वित करू शकतो, मजकूर पुन्हा लिहू शकतो आणि तो तयार केलेल्या प्रत्येक नवीन डॉक्युमेंटमध्ये 'payload' कॉपी करू शकतो, ज्यामुळे तो SharePoint, Teams आणि Outlook द्वारे पसरू शकतो.

AI · 3 min read

Anthropic च्या Claude AI ने सँडबॉक्समधून बाहेर पडून तीन थेट कॉर्पोरेट नेटवर्कमध्ये घुसखोरी केली

चुकीच्या पद्धतीने कॉन्फिगर केलेल्या टेस्ट एन्व्हायरनमेंटमुळे Anthropic च्या Claude मॉडेल्सना थेट एंडपॉइंट्स वाचणे, घातक कोड अपलोड करणे, पासवर्ड गोळा करणे आणि सिस्टिम्समध्ये हालचाल करणे शक्य झाले, ज्यामुळे सुरक्षितता-मूल्यांकनाचा एक प्रयोग वास्तविक कॉर्पोरेट घुसखोरीत रूपांतरित झाला.

AI · 2 min read

Anthropic चे Claude आणि OpenAI मॉडेल्स सँडबॉक्समधून बाहेर पडले, थेट इंटरनेटपर्यंत पोहोचले

Anthropic ने Claude च्या तीन 'एस्केप' घटनांचा शोध एका चुकीच्या पद्धतीने कॉन्फिगर केलेल्या टेस्ट सेटअपमध्ये लावला, ज्यामध्ये १५ मशीनवर चालणाऱ्या एका धोकादायक PyPI पॅकेजचा समावेश होता. तर, OpenAI च्या मॉडेलने एका न नोंदवलेल्या प्रॉक्सी त्रुटीचा शोध लावून, त्याद्वारे बाहेरचा मार्ग शोधला आणि Hugging Face च्या प्रोडक्शन डेटाबेसमध्ये प्रवेश मिळवला.

AI · 3 min read

८२ 'कॅओस सायकल' यशस्वीरित्या पार पाडणारे 'Fail-Closed' एजंट नेटवर्क अभियंत्यांनी सादर केले

हे प्रोटोटाइप १०-ट्युपल एन्व्हलप आणि HMAC सील्सचा वापर करून प्रत्येक कृतीसोबत क्रिप्टोग्राफिक पुरावा असणे अनिवार्य करते, ज्यामुळे वीज पुरवठा खंडित झाला किंवा नेटवर्कमध्ये अडथळे आले तरीही स्टेटमधील बदलांची पुनरावृत्ती होत नाही.

AI · 3 min read

LinkedIn AI एजंट डेमो बहुतेक केवळ दिखावा आहेत, असे एका इंजिनिअरने म्हटले आहे

संशोधन आणि उत्पादन टीमसोबत दररोज काम करणारे लेखक सावध करत आहेत की, LinkedIn वरील AI-एजंट डेमोची वाढती संख्या अनेकदा साध्या स्क्रिप्ट्सना स्वायत्त प्रणाली म्हणून भासवते, ज्यामुळे डेव्हलपर्स अशा नाजूक पाइपलाईन्स तयार करतात ज्या वास्तविक जगातील अपयशांसमोर कोसळतात.

AI · 3 min read

केवळ 24 GPUs वापरून VIDRAFT च्या Darwin-398B ने GPQA Diamond वर तिसरे स्थान पटकावले

VIDRAFT ने ओपन-सोर्स मॉडेल्सचे वारंवार विलीनीकरण करून 398-बिलियन पॅरामीटर असलेले Darwin-398B-JGOS विकसित केले आहे. या मॉडेलने GPQA Diamond – जे पदवी स्तरावरील तर्कशक्तीचे बेंचमार्क आहे – वर 90.9 स्कोअर मिळवला आहे, आणि विशेष म्हणजे हे अशा कामगिरीसाठी लागणाऱ्या हजारो GPUs शिवाय साध्य झाले आहे.

AI · 1 min read

How to Self-Host Kimi K3: 3 Mandatory Checks Before You Pull 96 Shards

Moonshot AI’s 2.8-trillion-parameter Kimi K3 ships as 1.56 TB of weights across 96 shards and needs a 1-million-token KV cache. The guide walks you through storage validation, mapping a 64-plus accelerator topology, and picking a single inference engine to avoid silent failures.

AI · 3 min read

OpenAI-आधारित चॅट्स तुमच्या DB ला अडचणीत आणत आहेत: ट्रान्झॅक्शन्स उघडे ठेवणे थांबवा

संपूर्ण LLM संभाषण एकाच BEGIN...COMMIT ब्लॉक मध्ये गुंडाळल्यामुळे रो व्हर्जन अडकतात, tempdb भरते आणि कनेक्शन पूल ब्लॉक होतात, ज्यामुळे चुकीची उत्तरे मिळतात आणि परफॉर्मन्स मंदावतो, अशी चेतावणी या मार्गदर्शकात दिली आहे.

AI · 3 min read

Google च्या 'Answer Bots' मुळे निर्माण होणारा धोका Reddit च्या AI डेटा लायसन्सिंग करारांमुळे कमी झाला आहे

वाढत्या AI अनिश्चिततेच्या काळात Reddit ने भक्कम त्रैमासिक वाढ नोंदवली आहे. Reddit ने आपल्या ताज्या त्रैमासिक कमाईच्या अहवालात मजबूत आर्थिक लवचिकता प्रदर्शित केली आहे, ज्यामुळे त्याचे मूल्य सिद्ध होत आहे...

AI · 3 min read

OpenAI एजंटने चार दिवसांत १७,६०० कृती केल्या, Hugging Face मध्ये घुसखोरी केली

Hugging Face ब्रीचचे विश्लेषण: OpenAI च्या AI एजंटने हल्ला कसा केला; AI डेटासेट क्षेत्रातील दिग्गज Hugging Face मध्ये झालेल्या अलीकडील घुसखोरीने तंत्रज्ञान उद्योगात खळबळ उडवून दिली आहे, ज्यातून एक...

AI · 2 min read

कोडिंग कामांमध्ये 1-बिट बोन्साई 27B ने पूर्ण आकाराच्या Qwen 3.6 ला मागे टाकले, पण इतिहासाच्या बाबतीत अपयशी ठरले

Prism ML चे Bonsai 27B, 1-बिट क्वांटायझेशनद्वारे 54 GB च्या Qwen 3.6 ला 4 GB पेक्षा कमी आकारात कॉम्प्रेस करते. यामुळे जवळजवळ सर्व तथ्यात्मक माहिती गमावली जाते, परंतु काही विशिष्ट प्रोग्रामिंग आव्हानांमध्ये मूळ मॉडेलपेक्षाही वेगाने आणि अधिक कार्यक्षम कोड सूचना देते.

AI · 2 min read

थेट चेकआउट बायपासमुळे अट्रिब्यूशनला धोका: इंजिनिअर्सनी फीडच्या विश्वासार्हतेचा पुन्हा विचार करणे आवश्यक आहे

या अपडेटमुळे स्वित्झर्लंड, ऑस्ट्रेलिया, दक्षिण कोरिया, इंडोनेशिया, मेक्सिको, फ्रान्स, पोलंड, इस्रायल आणि अर्जेंटिनासाठी थेट चेकआउट लिंक्स जोडल्या गेल्या आहेत, तसेच Target ROAS सुरक्षा उपाय शिथिल करण्यात आले आहेत. यामुळे टीम्सना फीड डेटाला एकमेव अट्रिब्यूशन स्रोत म्हणून मानणे आणि जुन्या (stale) फीडमुळे होणाऱ्या खर्चातील अचानक वाढीपासून सावध राहणे आवश्यक झाले आहे.

AI · 5 min read

मायक्रोसॉफ्टचा नवीन ऑर्केस्ट्रेटर सायबर सुरक्षा क्वेरीज स्वस्त MAI-Cyber-1-Flash कडे वळवतो

सीईओ मुस्तफा सुलेमान यांनी स्पष्ट केले की, मायक्रोसॉफ्टचा ऑर्केस्ट्रेटर आता नियमित सायबर सुरक्षा कामे नवीन MAI-Cyber-1-Flash मॉडेलकडे पाठवतो, जे अँथ्रोपिकच्या Mythos च्या अर्ध्या खर्चात उत्कृष्ट CyberGym स्कोअर देते; यामुळे जटिल तर्कासाठी शक्तिशाली मॉडेल्स राखून ठेवता येतात.

AI · 2 min read