Mentre gli agenti AI si evolvono da semplici chatbot a lavoratori autonomi, si affidano sempre più al Model Context Protocol (MCP) per interagire con strumenti e dati esterni. Tuttavia, questa capacità comporta un costo nascosto in termini di finanza e prestazioni che Okta si sta muovendo per risolvere.
Comprendere la "Tool Tax" nell'orchestrazione dell'IA
Quando un agente AI interagisce con un ambiente tramite un server MCP, ogni singola chiamata al modello richiede che l'agente comprenda le capacità disponibili. Per farlo, il sistema deve passare l'intero elenco di schemi degli strumenti, nomi, descrizioni e parametri nel contesto del prompt.
Okta ha identificato questo fenomeno come la "tool tax". Man mano che il numero di strumenti integrati cresce, il sovraccarico del prompt si espande esponenzialmente. Ciò porta a un aumento significativo del consumo di token, che gonfia direttamente i costi operativi e aumenta la latenza per ogni passaggio di ragionamento dell'agente. Per le implementazioni su scala enterprise che gestiscono centinaia di strumenti, questo sovraccarico può diventare un importante collo di bottiglia sia per il budget che per le prestazioni.
Risolvere il sovraccarico con l'MCP basato sull'identità
Per mitigare questa inefficienza, Okta sta introducendo liste di strumenti MCP basate sull'identità (identity-scoped). Invece di trasmettere ogni strumento disponibile a ogni richiesta del modello, l'approccio di Okta utilizza l'identity and access management (IAM) per filtrare dinamicamente l'insieme degli strumenti.
Implementando lo scoping basato sull'identità, il server MCP fornisce solo le definizioni degli strumenti specifici che l'utente o l'agente autenticato è autorizzato a utilizzare. Se un agente agisce per conto di un dipendente junior, riceve solo un sottoinsieme dello schema totale degli strumenti; se agisce per conto di un amministratore, riceve l'intera suite. Ciò garantisce che la finestra di contesto del modello non venga intasata da descrizioni di strumenti irrilevanti o non autorizzati, riducendo efficacemente il numero di token richiesti per ogni chiamata di inferenza.
Perché questo è importante per l'ecosistema dell'IA
Questo sviluppo segna un passaggio critico da un'IA "centrata sulle capacità" (capability-centric) a un'IA "centrata sulla governance" (governance-centric). Mentre gli sviluppatori si muovono verso workflow agentici più complessi, il settore si sta rendendo conto che la scalabilità non può essere raggiunta attraverso il prompting con la forza bruta.
La strategia di Okta affronta due degli ostacoli più significativi nell'adozione dell'IA in ambito enterprise: l'ottimizzazione dei costi e la sicurezza. Legando l'esposizione degli strumenti all'identità, Okta non solo riduce la "tool tax", ma applica anche il principio del minimo privilegio a livello di protocollo. Ciò garantisce che un agente AI non possa accidentalmente scoprire o tentare di chiamare una funzione sensibile — come uno strumento di eliminazione del database — semplicemente perché lo schema di quello strumento era presente nel contesto del prompt.
Punti chiave
- Riduzione dello spreco di token: L'MCP basato sull'identità limita gli schemi degli strumenti inviati agli LLM, abbassando direttamente la "tool tax" e riducendo i costi di inferenza.
- Sicurezza migliorata: Filtrando gli strumenti in base all'identità dell'utente, Okta impone rigorosi controlli di accesso, impedendo agli agenti di accedere a funzioni non autorizzate.
- Workflow agentici scalabili: Lo scoping consente alle aziende di distribuire vaste librerie di strumenti senza l'aumento lineare della latenza e del sovraccarico del prompt tipico delle implementazioni MCP su larga scala.
In sintesi: Legando l'esposizione degli strumenti all'identità, Okta riduce l'eccesso di token che ha ostacolato le implementazioni di agenti AI su larga scala, rafforzando al contempo la sicurezza. Questa mossa spinge l'industria verso un'IA centrata sulla governance, dove costi, velocità e controllo degli accessi sono integrati nel protocollo piuttosto che aggiunti in un secondo momento.
