Nessuno ha votato per l'azienda che ora concede in licenza il web
Cloudflare ha introdotto una nuova struttura di prezzi il 1° luglio, sostituendo il suo consolidato modello "pay-per-crawl" con uno schema "pay-per-use" che paga gli editori ogni volta che un sistema di IA consuma i loro contenuti. Il cambiamento ha introdotto anche il blocco automatico dei crawler a uso misto sulle pagine che contengono annunci pubblicitari, con effetto dal 15 settembre. Questo spostamento trasforma il provider di CDN e sicurezza nel gatekeeper de facto di chi può leggere il web e a quali condizioni, un passo che potrebbe rimodellare l'economia dell'addestramento dell'IA e l'intero ecosistema di internet.
Perché questa modifica ai prezzi è importante
Con il vecchio sistema, un bot che voleva recuperare una pagina pagava a Cloudflare una tariffa per ogni richiesta. La tariffa andava a Cloudflare, non al proprietario del sito. Il nuovo modello inverte questo flusso: quando un modello di IA accede a una pagina, l'editore riceve un pagamento da Cloudflare. La parte relativa al pagamento è positiva: fornisce denaro ai proprietari dei siti.
L'effetto pratico colpisce immediatamente chiunque stia costruendo un crawler per l'IA. Se il crawler viene classificato come "a uso misto" – ovvero indicizza le pagine per la ricerca ed estrae contenuti per l'addestramento – Cloudflare lo blocca per impostazione predefinita su qualsiasi pagina che serva annunci pubblicitari. Per ottenere l'accesso, l'operatore deve pagare la tariffa di Cloudflare o accettare che quelle pagine siano fuori portata.
L'impalcatura delle policy dietro il cambiamento
La specifica del prodotto di Cloudflare suddivide i crawler di IA in tre categorie:
- Search – bot che indicizzano le pagine per alimentare un motore di ricerca.
- Agent – bot che recuperano informazioni per un'IA conversazionale o un agente simile.
- Training – bot che raccolgono testo, immagini o altri dati per addestrare un modello di machine learning.
La categorizzazione non è dettata dalla legge o da uno standard di settore; è il team interno di Cloudflare a deciderla. Quel team assegna inoltre ogni bot a una categoria, ad esempio stabilendo se un crawler orientato alla ricerca conti come "agent" o come "trainer", o se un bot di archiviazione conti come un bot di "search".
Queste classificazioni influenzano direttamente se un bot viene bloccato, quanto gli viene addebitato e se l'editore riceve un pagamento.
Chi vince e chi perde
Editori
I proprietari dei siti ora ottengono un nuovo flusso di entrate. Ogni volta che un modello di IA legge il loro articolo, Cloudflare invia loro un pagamento.
Sviluppatori di IA
Startup e laboratori di ricerca che si affidano a dataset ampi e diversificati devono ora affrontare un ulteriore livello di costi. Se un crawler non è nell'elenco approvato da Cloudflare, lo sviluppatore deve pagare la tariffa per ogni utilizzo o perdere l'accesso a una parte significativa del web.
La logica commerciale dietro la scarsità
Il modello di Cloudflare crea scarsità per gestire un marketplace. Per impostazione predefinita, i bot a uso misto sono bloccati sulle pagine contenenti annunci, trasformando ogni richiesta in un evento fatturabile. Se l'azienda bloccasse tutti i bot, eliminerebbe il proprio flusso di entrate. Il blocco selettivo protegge quindi il fatturato e costringe gli operatori di bot a un rapporto di pagamento.
Il cambiamento sfrutta anche l'enorme base di utenti del piano gratuito di Cloudflare. Milioni di siti si sono iscritti perché il piano gratuito offriva servizi CDN e di sicurezza semplici. Quell'accesso "gratuito" era una strategia di acquisizione clienti, non un'offerta caritatevole. Ora quei siti appartengono a una rete che genera entrate per Cloudflare quando l'IA consuma i loro contenuti, ma i siti non hanno voce in capitolo sulla determinazione dei prezzi o sulle categorie di policy che stabiliscono chi riceve il pagamento.
In sintesi
La revisione del modello pay-per-use di Cloudflare fa molto di più che aggiungere una nuova voce di ricavo; conferisce all'azienda il potere di etichettare, addebitare e, in ultima analisi, decidere quali crawler di IA possono leggere il web.
