GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Google અને Anthropic એ ચેતવણી આપી છે કે ReAct એજન્ટ્સ ક્લાઉડ બજેટને ખાલી કરી શકે છે

ReAct લૂપ મોડેલને તેના પોતાના સ્ટેપ્સ પસંદ કરવાની મંજૂરી આપે છે, પરંતુ દરેક Thought-Action-Observation સાયકલ વધારાનો ઇન્ફરન્સ ચાર્જ ઉમેરે છે, જેનાથી લેટન્સી વધે છે અને એક નાની ભૂલ આખા કાર્યને ખોટી દિશામાં લઈ જવાની શક્યતા વધી જાય છે.

AI · 3 min read

Google એ સ્વોર્મ એજન્ટ પેટર્નને સૌથી શક્તિશાળી છતાં સૌથી ખર્ચાળ AI ડિઝાઇન તરીકે દર્શાવી છે

સ્વોર્મ એક સિંગલ સુપરવાઈઝરને બદલે પીઅર એજન્ટ્સના ફ્લેટ નેટવર્કનો ઉપયોગ કરે છે જે સતત એકબીજાનું મૂલ્યાંકન કરે છે, પરંતુ દરેક વિનિમય એક અલગ મોડેલ કોલને ટ્રિગર કરે છે, જેનાથી કમ્પ્યુટિંગ ખર્ચ અને લેટન્સીમાં નોંધપાત્ર વધારો થાય છે.

AI · 3 min read

ક્લાસિક RAG ની સરખામણીમાં એજન્ટિક રિટ્રીવલ ક્વેરી ખર્ચમાં 82 ગણો સુધીનો ઘટાડો કરે છે

એજન્ટ ક્વેરીઓને ફરીથી લખે છે, સર્ચની જરૂર છે કે નહીં તેનો નિર્ણય લે છે, જટિલ પ્રશ્નોને પેટા-પગલાઓમાં વિભાજિત કરે છે અને જ્યારે પુરાવા નબળા હોય ત્યારે પોતાની જાતે સુધારો કરે છે, દરેક દાવા માટે સંદર્ભ પૂરા પાડે છે અને ટોકન વપરાશમાં ભારે ઘટાડો કરે છે.

AI · 3 min read

New COS API Lets Browsers Share 33 GB AI Model Across Sites

By replacing URL lookups with content-addressed hashes, the COS API lets any site request a file it already knows the SHA-256 of, letting browsers serve the same 33 GB AI model to multiple origins without re-downloading it.

AI · 2 min read

તમારું ઇવેલ્યુએશન હાર્નેસ મોડેલની ભૂલોનું ખોટું નિરૂપણ કરી શકે છે—બે બગ્સ 'Malformed' લેબલ્સ પાછળ છુપાયેલા હતા

તમારું મોડેલ જૂઠું બોલતા પહેલા તમારું હાર્નેસ તમને છેતરી દેશે. તમારા ઇવેલ્યુએશન સ્કોરબોર્ડ મુજબ બંને એન્જિન નિષ્ફળ ગયા હતા. Llama3.2 6 માંથી 5 કિસ્સાઓમાં નિષ્ફળ રહ્યું હતું. Anthropic Sonnet 6 માંથી 6 કિસ્સાઓમાં નિષ્ફળ રહ્યું હતું...

AI · 2 min read

લિનિયર-સ્કેલ ટ્રાન્સફોર્મર્સ પ્રોટીન મોડેલ મેમરીને ક્વાડ્રેટિકથી લિનિયર સ્તરે ઘટાડે છે

આ નવું આર્કિટેક્ચર લાંબા અંતરના ઇન્ટરેક્શનને જાળવી રાખીને, એક જ પાસમાં હજારો એમિનો-એસિડની આખી સાંકળોને પ્રોસેસ કરે છે, જેનાથી વિશાળ સિક્વન્સ કોર્પોરા પર તાલીમ આપવી વધુ ઝડપી અને સસ્તી બને છે.

AI · 2 min read

AWS Deploys x402 ‘AgentCore Payments’ to Auto-Bill AI Calls on Bedrock

The new x402 protocol embeds a payment token in each HTTP request, letting AI agents automatically deduct fees for data, compute or API calls. AWS’s Bedrock integration, called AgentCore Payments, adds built-in wallets and spend caps for seamless machine commerce.

AI · 3 min read

MCP v2 હેન્ડશેક અને સેશન આઈડીને દૂર કરી રહ્યું છે, જે સાચા સર્વરલેસ સ્કેલિંગને સક્ષમ બનાવે છે

28 જુલાઈ 2026 થી લાઈવ થનારું MCP વર્ઝન 2, ઇનિશિયલાઇઝ હેન્ડશેક, Mcp-Session-Id હેડર અને ત્રણ લેગસી સબસિસ્ટમ્સને દૂર કરીને પ્રોટોકોલને સંપૂર્ણપણે સ્ટેટલેસ બનાવે છે. હવે ટીમો સેશન-એફિનિટીના અવરોધો વિના ઓટોસ્કેલ અથવા સર્વરલેસ પોડ્સ પર કાર્ય કરી શકે છે.

AI · 3 min read

Google Gemma-4 31B Passes Token Match on AWS Inferentia Yet Spews Gibberish

The Inferentia2 INF2.24xlarge reproduced the exact token stream of the CPU reference, but both runs fed a malformed prompt lacking the chat template and turn markers, sending Gemma-4 into an infinite loop of nonsense. The hardware merely echoed a bug in the reference code.

AI · 3 min read

Solo Researcher Cuts LLM Agent Bill 31% to $651 by Logging Every Token

By adding a PostgreSQL logging layer that captured model name, token count, task type, and per-call cost, the researcher identified that raw SEC search results were inflating prompts. Summarizing those results and routing simple checks to a cheaper model drove the 31% savings and nudged accuracy up

AI · 3 min read

Upper90 જનરલ કમ્પ્યુટમાં $400 મિલિયનનું રોકાણ કરી રહ્યું છે, ઇન્ફરન્સ-ઓન્લી ચિપ્સ પર દાવ લગાવી રહ્યું છે

આ લોન માટે SambaNova ની SN50 ઇન્ફરન્સ ચિપ્સને કોલેટરલ તરીકે ઉપયોગમાં લેવામાં આવે છે, જે એક અનોખી એસેટ ક્લાસ છે જે પરંપરાગત GPU ફાર્મ્સ કરતા 16 ગણી ઝડપી ટોકન પ્રોસેસિંગ, ઓછો પાવર વપરાશ અને સરળ કૂલિંગનું વચન આપે છે.

AI · 3 min read

લિનસ ટોરવાલ્ડ્સનો ટીકાકારોને એક જ વિકલ્પ: લિનક્સને ફોર્ક કરો અથવા AI ને અપનાવો

ટોરવાલ્ડ્સે મેઇલિંગ લિસ્ટને જણાવ્યું હતું કે નવા Sashiko રિવ્યુઅર જેવા AI ટૂલ્સનો વિરોધ કરનાર કોઈપણ વ્યક્તિ સરળતાથી કર્નલને ફોર્ક કરી શકે છે, જે તેમના એ મંતવ્ય પર ભાર મૂકે છે કે ટેકનિકલ યોગ્યતા વૈચારિક અવરોધો કરતા વધુ મહત્વની છે.

AI · 2 min read

OpenAI ના GPT-Red એ GPT-5.6 ની નિષ્ફળતાઓમાં છ ગણો ઘટાડો કર્યો, પરંતુ નાની ટીમો માટે કોઈ મફત સાધન નથી

OpenAI ના આંતરિક GPT-Red મોડેલે GPT-5.6 Sol લાઇન માં નિષ્ફળતાઓને છ ગણી ઘટાડી દીધી છે, પરંતુ સંશોધન પત્ર માત્ર સિદ્ધાંત આપે છે—ડાઉનલોડ કરી શકાય તેવું કોઈ સાધન નથી—જેના કારણે નાની ટીમોએ તેમના પોતાના નિશ્ચિત (deterministic) પરીક્ષણો જાતે જ બનાવવા પડશે.

AI · 4 min read