GyaanSetu AI

AI, இயந்திரக் கற்றல் மற்றும் LLM நுண்ணறிவுகள்.

1515 articlesDeep, practical knowledge

ReAct ஏஜெண்டுகள் கிளவுட் பட்ஜெட்களைக் கரைக்கக்கூடும் என்று கூகுள் மற்றும் ஆந்த்ரோபிக் எச்சரிக்கின்றன

ReAct லூப் ஒரு மாடல் தனது சொந்தப் படிகளைத் தேர்ந்தெடுக்க அனுமதிக்கிறது, ஆனால் ஒவ்வொரு 'சிந்தனை-செயல்-கவனிப்பு' (Thought-Action-Observation) சுழற்சியும் கூடுதல் இன்ஃபரன்ஸ் கட்டணத்தைச் சேர்க்கிறது; இது தாமதத்தை அதிகரிப்பதோடு, ஒரு சிறிய தவறான புரிதல் கூட முழுப் பணியையும் திசைதிருப்பும் வாய்ப்பையும் உருவாக்குகிறது.

AI · 3 min read

ஸ்வார்ம் ஏஜென்ட் பேட்டர்ன் மிகவும் சக்திவாய்ந்த அதே சமயம் அதிக செலவுமிக்க AI வடிவமைப்பு என்று கூகுள் சுட்டிக்காட்டுகிறது

ஸ்வார்ம் முறையில், ஒரு தனி மேற்பார்வையாளருக்குப் பதிலாக, ஒன்றையொன்று தொடர்ந்து விமர்சித்துக் கொள்ளும் சமமான ஏஜென்ட்களின் நெட்வொர்க் பயன்படுத்தப்படுகிறது; ஆனால் ஒவ்வொரு பரிமாற்றமும் ஒரு தனி மாடல் அழைப்பைத் தூண்டுவதால், கணினிச் செலவும் தாமதமும் (latency) மிக அதிகமாக உயர்கின்றன.

AI · 3 min read

Agentic Retrieval Cuts Query Costs Up to 82x vs Classic RAG

The agent rewrites queries, decides if a search is needed, breaks complex questions into sub-steps and self-corrects when evidence is weak, delivering citations for every claim and slashing token usage dramatically.

AI · 3 min read

அமெரிக்க படைப்பாளிகளுக்காக முன்னோடித் திட்டமாக AI டீப்ஃபேக் கண்டறியும் கருவியை டிக்டாக் அறிமுகப்படுத்துகிறது

Jumio மூலம் செல்ஃபி மற்றும் அடையாளச் சரிபார்ப்பு முறையை வெற்றிகரமாக முடித்த பிறகு, இந்த விருப்பத்தேர்வு சேவை அமெரிக்க படைப்பாளிகளின் ஒரு சிறிய குழுவிற்கு ஒரு டேஷ்போர்டை வழங்குகிறது. இதில் அவர்களின் சரிபார்க்கப்பட்ட முக அம்சங்களுடன் ஒத்துப்போவதாக AI கண்டறியும் வீடியோக்கள் அல்லது படங்கள் பட்டியலிடப்படும்.

AI · 1 min read

புதிய COS API, 33 GB AI மாதிரியைப் பல்வேறு இணையதளங்களுக்கு இடையே உலாவிகள் பகிர அனுமதிக்கிறது

URL தேடல்களுக்குப் பதிலாக உள்ளடக்கத்தால் அடையாளம் காணக்கூடிய ஹாஷ்களைப் (content-addressed hashes) பயன்படுத்துவதன் மூலம், COS API எந்தவொரு தளமும் தனக்குத் தெரிந்த SHA-256 குறியீட்டைக் கொண்ட கோப்பைக் கோர அனுமதிக்கிறது. இதன் மூலம், உலாவிகள் அதே 33 GB AI மாதிரியை மீண்டும் பதிவிறக்கம் செய்யாமலேயே பல தளங்களுக்கு வழங்க முடியும்.

AI · 2 min read

நேரியல்-அளவிலான டிரான்ஸ்பார்மர்கள் புரத மாதிரியின் நினைவகத் தேவையை குவாட்ராடிக்கிலிருந்து நேரியலுக்குக் குறைக்கின்றன

இந்த புதிய கட்டமைப்பு ஆயிரக்கணக்கான அமினோ அமிலச் சங்கிலிகளை ஒரே முறையில் செயலாக்குகிறது; இது நீண்ட தூரத் தொடர்புகளைப் பாதுகாப்பதோடு, மிகப்பெரிய வரிசைத் தொகுப்புகளில் பயிற்சி அளிப்பதையும் வேகமாகவும் செலவு குறைந்ததாகவும் மாற்றுகிறது.

AI · 2 min read

AWS Deploys x402 ‘AgentCore Payments’ to Auto-Bill AI Calls on Bedrock

The new x402 protocol embeds a payment token in each HTTP request, letting AI agents automatically deduct fees for data, compute or API calls. AWS’s Bedrock integration, called AgentCore Payments, adds built-in wallets and spend caps for seamless machine commerce.

AI · 3 min read

$55 மில்லியன் நிதித் திரட்டிய பிறகு, Carebricks ஏஜென்ட்கள் ஆய்வக ஆர்டர்கள் மற்றும் சிகிச்சைத் திட்டங்களை தானியக்கமாக்கும்

Sequoia, Felicis, Optum Ventures மற்றும் Y Combinator ஆகியவற்றின் ஆதரவுடன், Bunkerhill நிறுவனம் தனது Carebricks ஏஜென்ட்களின் முன்னோடிப் பயன்பாடுகளைத் தொடங்கத் திட்டமிட்டுள்ளது. இந்த மென்பொருள் EHR தரவுகளைப் பெறுதல், ஆய்வக ஆர்டர்களை வழங்குதல் மற்றும் சிகிச்சைத் திட்டங்களைப் புதுப்பித்தல் போன்ற பணிகளைச் செய்வதன் மூலம், மருத்துவர்களின் அன்றாட ஒருங்கிணைப்புப் பணிகளைக் குறைக்க உதவும்.

AI · 2 min read

Google Gemma-4 31B, AWS Inferentia-வில் டோக்கன் மேட்ச் தேர்ச்சி பெற்றாலும், அர்த்தமற்ற வார்த்தைகளையே வெளியிடுகிறது

Inferentia2 INF2.24xlarge, CPU ரெஃபரன்ஸின் அதே டோக்கன் ஓட்டத்தை அப்படியே பிரதிபலித்தது, ஆனால் இரண்டு முறைகளுமே சாட் டெம்ப்ளேட் மற்றும் டர்ன் மார்க்கர்கள் இல்லாத தவறான ப்ராம்ப்ட்களை வழங்கியதால், Gemma-4 அர்த்தமற்ற வார்த்தைகளின் முடிவில்லா சுழற்சிக்குள் தள்ளப்பட்டது. வன்பொருள் என்பது ரெஃபரன்ஸ் கோடில் உள்ள பிழையை அப்படியே பிரதிபலித்தது மட்டுமே.

AI · 3 min read

Solo Researcher Cuts LLM Agent Bill 31% to $651 by Logging Every Token

By adding a PostgreSQL logging layer that captured model name, token count, task type, and per-call cost, the researcher identified that raw SEC search results were inflating prompts. Summarizing those results and routing simple checks to a cheaper model drove the 31% savings and nudged accuracy up

AI · 3 min read

விமர்சகர்களுக்கு லினஸ் டோர்வால்ட்ஸ் ஒரு தேர்வைக் கொடுக்கிறார்: லினக்ஸை ஃபோர்க் செய்யவும் அல்லது AI-ஐ ஏற்றுக்கொள்ளவும்

புதிய Sashiko ரிவியூவர் போன்ற AI கருவிகளுக்கு எதிர்ப்பு தெரிவிப்பவர்கள் எவரும் கர்னலை (kernel) எளிதாக ஃபோர்க் செய்யலாம் என்று டோர்வால்ட்ஸ் மின்னஞ்சல் பட்டியலிடம் கூறினார். தொழில்நுட்பத் தரம் கருத்தியல் எதிர்ப்பை விட மேலானது என்ற தனது கருத்தை இது அடிக்கோடிட்டுக் காட்டுகிறது.

AI · 2 min read

Grok Build-ன் ஓப்பன் சோர்ஸ் CLI, மாடல்களை மாற்றவும் மற்றும் ஒவ்வொரு ஷெல் கட்டளையையும் ஆய்வு செய்யவும் அனுமதிக்கிறது

இந்தத் தொகுப்பு CLI, டெர்மினல் UI மற்றும் ரன்டைம் ஆகியவற்றிற்கான Rust மூலக் குறியீட்டை வழங்குகிறது; இதன் மூலம் சூழல் எவ்வாறு ஒருங்கிணைக்கப்படுகிறது, கருவிகள் எவ்வாறு வழிநடத்தப்படுகின்றன மற்றும் திருத்தங்கள் எவ்வாறு நிர்வகிக்கப்படுகின்றன என்பதை நீங்கள் ஆய்வு செய்யலாம் – மேலும் பணிப்பாய்வு பாதிக்கப்படாமல் அடிப்படை மாடலை கூட மாற்றிக்கொள்ள முடியும்.

AI · 4 min read

AA-Briefcase சோதனையில் Moonshot-ன் Kimi K3, GPT-5.6-ஐ முறியடித்தது; 1,495-க்கு எதிராக 1,527 புள்ளிகளைப் பெற்றது

2.8 டிரில்லியன் அளவுருக்களைக் கொண்ட திறந்த-எடை மாதிரியான Moonshot AI-ன் Kimi K3, யதார்த்த உலக AA-Briefcase அளவுகோலில் GPT-5.6-ஐ விட அதிக மதிப்பெண்களைப் பெற்றுள்ளது. இது தற்போது API மூலம் கிடைக்கிறது, மேலும் இதன் எடைகள் ஜூலை 27 அன்று பொதுமக்களின் பயன்பாட்டிற்கு வெளியிடப்பட உள்ளன.

AI · 2 min read

Claude Code, Cursor 2.0 மற்றும் OpenAI Codex ஆகியவை IDE-களை முழுமையான ஸ்டாக் கட்டுப்பாட்டு அறைகளாக மாற்றுகின்றன

சமீபத்திய பதிப்புகள் பணி ஒருங்கிணைப்பு, ஒப்புதல் பணிப்பாய்வுகள், சோதனை கட்டமைப்புகள் மற்றும் UI-ஐ உணர்ந்த உலாவல் போன்ற வசதிகளைச் சேர்க்கின்றன; இதன் மூலம் ஒரு AI தானாகவே டிக்கெட்டுகளைத் தேர்ந்தெடுக்கவும், தன்னாட்சி முகவர்களை இயக்கவும், மனித ஒப்புதலைப் பெறவும் மற்றும் காட்சி முன்னோட்டங்களை அனுப்பவும் முடியும்—இவை அனைத்தும் ஒரே கன்சோலில் இருந்து சாத்தியமாகும்.

AI · 3 min read

மிச்சிகன் சரிபார்ப்பில் Epic-ன் செப்சிஸ் எச்சரிக்கை மூன்றில் இரண்டு பங்கு வழக்குகளைத் தவறவிட்டது

2021-ல் மருத்துவரைத் துல்லியமாகக் கணிக்கக் கற்ற செப்சிஸ் மாடல்; மிச்சிகன் மெடிசின் Epic செப்சிஸ் மாடலைச் சோதித்தது. அவர்கள் 38,455 மருத்துவமனைத் தங்குதல்களை ஆய்வு செய்தனர். Epic அதன் துல்லியம் அதிகமாக இருப்பதாகக் கூறியது...

AI · 4 min read

1-Bit Bonsai 27B Runs at 11 Tokens/S on iPhone 17 Pro Max, Cutting Model Size 14-Fold

PrismML’s Bonsai 27B shrinks from a 54.7 GB full-precision model to a 3.9 GB 1-bit file, fitting on a flagship iPhone while retaining 89.5% of its quality. The claim relies on Apple’s MLX stack and delivers about 11 tokens per second, but memory, heat and battery impacts remain unmeasured.

AI · 3 min read