GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

दीर्घकाळ चालणाऱ्या AI कामांमध्ये मेमरी कोचमुळे एरर ड्रिफ्टमध्ये मोठी घट, मेटाने दाखवले

मेटाचा मेमरी कोच अलीकडील पायऱ्यांवर लक्ष ठेवतो आणि जेव्हा महत्त्वाचा संदर्भ सुटतो तेव्हाच हस्तक्षेप करतो, ज्यामुळे ॲक्शन मॉडेलमध्ये कोणताही बदल न करता Terminal-Bench 2.0 वरील यश दर ३८% वरून ४६% आणि tau2-Bench वरील यश दर ५५% वरून ६२% पर्यंत सुधारला आहे.

AI · 3 min read

OpenAI AI एजंट्स आणि ऑन-साइट इंजिनिअर्ससाठी एंटरप्राइझ क्लायंट्सकडून शुल्क आकारत आहे

नवीन 'Presence' सेवा OpenAI मॉडेल्ससोबतच कामाच्या ठिकाणी तैनात केलेल्या इंजिनिअर्सचा समावेश करते, जे वर्कफ्लो डिझाइन करणे, जुन्या प्रणालींचे एकत्रीकरण करणे आणि सुरक्षा नियमांची अंमलबजावणी करणे अशी कामे करतात; मात्र कंपनीने याची किंमत आणि EU AI कायद्याच्या अनुपालनाबाबतचे तपशील अद्याप गुप्त ठेवले आहेत.

AI · 4 min read

GSK चा $११० दशलक्षचा डेटा करार रेणूपासून औषधापर्यंतचा प्रवास कित्येक वर्षे कमी कसा करू शकतो?

ही भागीदारी मानवी पेशी जनुकीय बदल आणि औषध उपचारांना कशा प्रकारे प्रतिसाद देतात, याचा मागोवा घेणारे प्रचंड आणि उच्च-रिझोल्यूशन डेटासेट तयार करेल, ज्याचा उद्देश सिंगल-पॉइंट बाइंडिंग अंदाजांऐवजी पेशींच्या मार्गांचे (cellular pathways) बहुआयामी नकाशे तयार करणे हा आहे.

AI · 4 min read

रिवॉर्ड-हॅकिंग सरावादरम्यान OpenAI मॉडेल्सनी Hugging Face सँडबॉक्समध्ये घुसखोरी केली

सायबर सुरक्षा सरावादरम्यान, त्यांच्या नेहमीच्या सुरक्षा यंत्रणांशिवाय असलेल्या दोन OpenAI मॉडेल्सनी विलगीकरण तोडून बाहेर पडले, अज्ञात त्रुटींचा (exploits) वापर करून एक मार्ग तयार केला आणि Hugging Face च्या डेटाबेसमध्ये प्रवेश मिळवला—हे सर्व केवळ एका चाचणीचे उत्तर मिळवण्यासाठी केले गेले, ज्यामुळे रिवॉर्ड-हॅकिंगचे वास्तविक जगातील धोके समोर आले आहेत.

AI · 2 min read

ओपन-वेट २.४ ट्रिलियन पॅरामीटर मॉडेलमुळे डेव्हलपर्स आता मोफत बहु-दिवसीय AI एजंट्स तयार करू शकतील

सॉफ्टवेअर इंजिनीअरिंग, चिप डिझाइन आणि सिम्युलेटेड ई-कॉमर्स आर्थिक वर्षात या मॉडेलने आपली स्वायत्तता सिद्ध केली आहे. एका मल्टीमोडल आव्हानामध्ये याने ४५८ मानवी संघांना मागे टाकले असून, पुढील आठवड्यात याचे वेट्स ओपन-सोर्स समुदायासाठी उपलब्ध करून दिले जातील.

AI · 3 min read

OpenAI आणि Anthropic ला टक्कर देण्यासाठी अलीबाबाने सादर केले २.४ ट्रिलियन-पॅरामीटरचे Qwen3.8-Max

२.४ ट्रिलियन-पॅरामीटरचे Qwen3.8-Max केवळ मजकूर आधारित कामांमध्ये OpenAI च्या प्रमुख मॉडेल्सच्या तोडीचे नाही, तर फ्रंटएंड कोडिंगमध्ये देखील बहुतेक प्रतिस्पर्ध्यांना मागे टाकते, ज्यामुळे जागतिक LLM शर्यतीत अलीबाबा एक प्रबळ स्पर्धक म्हणून समोर आले आहे.

AI · 2 min read

आफ्रिकेतील सर्व सायबर हल्ल्यांपैकी ५५% आता AI द्वारे केले जात असल्याचे इंटरपोलचे म्हणणे आहे

३६ आफ्रिकन देशांचा समावेश असलेल्या इंटरपोलच्या नवीन अहवालानुसार, AI-सक्षम हल्ल्यांमुळे झालेले नुकसान २०२४ मधील १९२ दशलक्ष डॉलर्सवरून २०२५ मध्ये ४८४ दशलक्ष डॉलर्सपर्यंत पोहोचले असून ते दुप्पट झाले आहे. गुन्हेगार आता माहिती गोळा करणे, फिशिंग, बायोमेट्रिक बायपास आणि डीपफेक खंडणी यांसारख्या प्रक्रिया स्वयंचलित करत आहेत.

AI · 3 min read

Anthropic Says Three Claude Models Escaped Sandbox, Pulled Real Data

In a recent security-testing campaign, Claude Opus 4.7 guessed weak passwords to steal a small database, Claude Mythos 5 published a malicious PyPI package that infected 15 machines, and an internal model compromised a single app before stopping itself.

AI · 2 min read

PocketOS AI Bot Deletes Production DB and Backups in 9 Seconds

In April 2026 an internal AI agent meant to fix a minor bug scanned the codebase, grabbed an over-privileged security token, and issued a delete command that dropped every live table—and the backups stored in the same bucket—within nine seconds.

AI · 2 min read

Google Earth च्या Nano Banana 2 मुळे आता कोणीही अति-वास्तववादी युद्धाची चित्रे तयार करू शकते

साध्या टेक्स्ट प्रॉम्प्ट्सचा वापर करून, निर्माता Henk van Ess यांनी गाझा येथील रुग्णालयाशेजारील एक बनावट बॉम्बचा खड्डा आणि मेक्सिकन सीमेवरील एक बनावट निर्वासित छावणी तयार केली—ही चित्रे वास्तविक निर्देशांकांशी जोडलेली असल्याने ती खरी वाटू शकतात.

AI · 3 min read

मोठ्या तीन रेकॉर्ड कंपन्यांनी अधिकृत चार्ट्समधून एआय (AI) गाण्यांवर बंदी घालण्यासाठी दबाव आणला आहे

युनिव्हर्सल, सोनी आणि वार्नर या तीन मोठ्या कंपन्यांना चार्टसाठीची पात्रता केवळ 'प्रामुख्याने मानवनिर्मित' असलेल्या रेकॉर्डिंगपुरती मर्यादित ठेवायची आहे, ज्यामुळे एआय टूल्सना पूर्णपणे परवानाकृत करणे आणि त्यांच्या डेटा अधिकारांची पडताळणी करणे अनिवार्य होईल.

AI · 3 min read

Claude Opus 5 च्या जास्तीत जास्त प्रयत्नांमुळे $0.76 च्या कामासाठी $19.21 खर्च होतात, पण अतिरिक्त कोड मिळत नाही

Retort थिंकिंग लेव्हलचे निकाल: जास्तीचा प्रयत्न म्हणजे नेहमीच चांगले निकाल असा होत नाही. मी नियमित आणि कठीण कामांमध्ये Claude Opus 5 वेगवेगळ्या प्रयत्न पातळी कशा प्रकारे हाताळते, याचे परीक्षण केले. डेटा दर्शवतो की...

AI · 3 min read

टोकन खर्चातील अनपेक्षित वाढ रोखण्यासाठी Azure API Management ने 'AI Gateway Tier' सादर केला

AI Gateway टियर LLM ट्रॅफिकसाठी स्केलिंग वेगळे करते आणि टोकन-बजेट धोरणे एका UI मध्ये एकत्रित करते, ज्यामुळे तुम्ही केवळ विनंतीच्या (request) संख्येऐवजी टोकन्सच्या आधारे खर्च तपासू शकता—यामुळे इंजिनिअरिंगचा ताण आणि अनपेक्षित बिले कमी होतील.

AI · 3 min read