Il modello di licenza per i crawler AI di Cloudflare, lanciato il 1° luglio, sostituisce il vecchio schema "pay-per-crawl" con un sistema "pay-per-use" che addebita un costo ogni volta che un servizio di intelligenza artificiale legge una pagina. Il passaggio fa molto più che modificare un listino prezzi: conferisce a una singola azienda privata il potere di decidere chi può accedere al web pubblico e a quali condizioni.

Perché il cambiamento è importante

Per anni, il piano gratuito di Cloudflare ha offerto a milioni di siti un modo economico per migliorare le prestazioni e respingere il traffico indesiderato. Quando un bot recuperava una pagina, l'operatore pagava una tariffa fissa per ogni crawl. Il nuovo modello inverte questo rapporto: gli editori ricevono un pagamento ogni volta che un modello di IA consuma i loro contenuti. In superficie, sembra una vittoria per i proprietari dei siti, che finalmente ottengono una fetta della "torta dell'IA" che è cresciuta grazie al loro lavoro.

Il modello introduce inoltre tre nuove categorie per i crawler AI – Search, Agent e Training – e affida l'autorità di classificare un bot in uno di questi gruppi direttamente alle specifiche di prodotto di Cloudflare. L'azienda decide se un bot di ricerca è un legittimo "Agent" o un bot di "Training", se uno strumento di un piccolo team sia un servizio di "Search" o un "ladro senza licenza". Queste classificazioni determinano le tariffe applicate e, a partire dal 15 settembre, se il bot verrà bloccato direttamente sulle pagine che mostrano annunci pubblicitari.

La meccanica del controllo

  • Tre categorie, un unico guardiano – Solo Cloudflare definisce i tre gruppi. Nessun organismo di standard esterno, nessun consorzio di settore, nessuna consultazione pubblica. Un bot che rientra nella categoria "Training" affronta tariffe più elevate rispetto a uno etichettato come "Search", anche se l'attività sottostante è quasi identica.
  • Blocco predefinito sulle pagine con pubblicità – Dalla metà di settembre, a qualsiasi crawler con uso misto che atterri su una pagina con annunci verrà negato l'accesso, a meno che non soddisfi i criteri di Cloudflare. Il blocco è automatico; l'unico modo per aggirarlo è pagare la tariffa che Cloudflare stabilisce per quella categoria.
  • Un mercato con una lista d'attesa – L'accesso al web "con licenza" non dipende più solo dalla capacità tecnica. Le aziende che desiderano effettuare il crawling su larga scala devono richiedere l'inserimento nella lista approvata da Cloudflare. Chi rimane escluso si trova di fronte a due scelte drastiche: accettare il prezzo imposto da Cloudflare o perdere la capacità di effettuare lo scraping di una vasta porzione di Internet.
  • Entrate senza diritto di voto – I proprietari dei siti che ricevono i pagamenti non hanno voce in capitolo su come vengono definite le categorie, su come evolvono le tariffe o su chi viene inserito nella whitelist. La struttura dei prezzi e la definizione stessa di crawling "accettabile" risiedono dietro una specifica di prodotto aziendale, non in un processo di politica pubblica.

Chi vince e chi perde

Editori – Il beneficio immediato è un nuovo flusso di entrate. Ogni volta che un modello di IA legge un articolo, il proprietario del sito riceve un pagamento. Per gli editori più piccoli che hanno faticato a monetizzare il traffico, questo flusso di cassa può essere significativo.

Sviluppatori e ricercatori di IA – Coloro che possono permettersi le tariffe di Cloudflare e assicurarsi un posto nella whitelist continueranno ad addestrare ed eseguire modelli su larga scala.

Startup, progetti open-source e ricercatori indipendenti – Senza un posto nella whitelist, devono o pagare la tariffa stabilita da Cloudflare o perdere l'accesso a una vasta parte del web.

L'ecosistema internet nel suo complesso – Trasformando l'accesso al web pubblico in un servizio soggetto a licenza, Cloudflare concentra una forma di "gatekeeping digitale" che tradizionalmente apparteneva a un ambiente multi-attore e scarsamente regolamentato.

Il costo nascosto della scarsità

Bloccare i bot è stato a lungo inquadrato come una mossa difensiva contro spam, scraping e abuso di larghezza di banda. Nel nuovo modello di Cloudflare, il blocco è una dimostrazione di potere contrattuale; il vero prodotto è il contatore che misura ogni visualizzazione di pagina e le applica un prezzo. L'azienda può azionare l'interruttore che crea scarsità per tutti contemporaneamente, perché gestisce anche il mercato che vende l'accesso.

Il piano gratuito che ha attirato la maggior parte del traffico web odierno non è mai stato un atto di carità. È stato un punto di ingresso strategico che ha garantito a Cloudflare la dominanza del mercato, permettendole in seguito di monetizzare tale dominanza attraverso il modello di licenza. Ora, la stessa infrastruttura che un tempo ha democratizzato il caricamento rapido delle pagine decide anche chi può leggere quelle pagine.

Controargomentazione: pagare per i contenuti che alimentano l'IA

L'argomento a favore del nuovo sistema è semplice: gli sviluppatori di IA hanno tratto profitto da testi, immagini e codice disponibili pubblicamente senza compensare i creatori. Il modello di Cloudflare impone un ciclo di pagamenti che potrebbe incentivare contenuti di qualità superiore e dare agli editori una partecipazione all'economia dell'IA. Fornisce inoltre un modo chiaro ed applicabile per distinguere tra bot di ricerca benigni e operazioni massicce di raccolta dati, limitando potenzialmente gli abusi.

Quei vantaggi, tuttavia, non cancellano il fatto che le regole siano stabilite unilateralmente. Anche se la ripartizione dei ricavi è generosa, la mancanza di un processo democratico significa che il pubblico non ha modo di intervenire se le categorie si rivelassero arbitrarie o se le tariffe diventassero sfruttatrici. Il modello scambia un insieme di decisioni opache (euristiche di ad-blocking) con un altro insieme, dalle conseguenze finanziarie più rilevanti.

Cosa osservare in seguito

In sintesi

La revisione dei prezzi di Cloudflare del 1° luglio trasforma l'atto di leggere una pagina web in una transazione soggetta a licenza, con una singola azienda privata che scrive le regole e incassa le commissioni. Mentre gli editori vedono finalmente arrivare dei guadagni dal consumo guidato dall'IA, la conseguenza più ampia è una nuova forma di gatekeeping digitale che ridefinisce chi può accedere alla rete pubblica e a quali condizioni. La vera storia non è il prezzo; è la concentrazione del controllo in uno spazio che per lungo tempo è stato considerato aperto.