Nadie votó por la empresa que ahora licencia la web
Cloudflare implementó una nueva estructura de precios el 1 de julio, cambiando su veterano modelo de "pago por rastreo" por un esquema de "pago por uso" que paga a los editores cada vez que un sistema de IA consume su contenido. El cambio también introdujo el bloqueo automático de rastreadores de uso mixto en páginas que contienen anuncios, con efecto a partir del 15 de septiembre. Este giro convierte al proveedor de CDN y seguridad en el guardián de facto de quién puede leer la web y bajo qué términos, un movimiento que podría remodelar la economía del entrenamiento de IA y el ecosistema de internet en general.
Por qué es importante este ajuste de precios
Bajo el sistema anterior, un bot que quisiera obtener una página pagaba a Cloudflare una tarifa por cada solicitud. La tarifa iba a Cloudflare, no al propietario del sitio. El nuevo modelo invierte ese flujo: cuando un modelo de IA accede a una página, el editor recibe un pago de Cloudflare. La parte del pago es positiva; proporciona dinero a los propietarios de los sitios.
El efecto práctico afecta de inmediato a cualquiera que esté construyendo un rastreador de IA. Si el rastreador se clasifica como de "uso mixto" —es decir, que tanto indexa páginas para búsquedas como extrae contenido para entrenamiento— Cloudflare lo bloquea de forma predeterminada en cualquier página que muestre anuncios. Para obtener acceso, el operador debe pagar la tarifa de Cloudflare o aceptar que esas páginas están fuera de su alcance.
El andamiaje de políticas detrás del cambio
La especificación de productos de Cloudflare agrupa los rastreadores de IA en tres categorías:
- Búsqueda – bots que indexan páginas para alimentar un motor de búsqueda.
- Agente – bots que recuperan información para una IA conversacional o un agente similar.
- Entrenamiento – bots que recolectan texto, imágenes u otros datos para entrenar un modelo de aprendizaje automático.
La categorización no está dictada por la ley ni por un estándar de la industria; la decide el equipo interno de Cloudflare. Ese mismo equipo asigna cada bot a una categoría; por ejemplo, si un rastreador orientado a la investigación cuenta como un "agente" o un "entrenador", o si un bot de archivo cuenta como un bot de "búsqueda".
Estas clasificaciones afectan directamente si un bot es bloqueado, cuánto se le cobra y si el editor recibe un pago.
Quién gana y quién pierde
Editores
Los propietarios de sitios ahora obtienen una nueva fuente de ingresos. Cada vez que un modelo de IA lee su artículo, Cloudflare les envía un pago.
Desarrolladores de IA
Las startups y los laboratorios de investigación que dependen de conjuntos de datos grandes y diversos ahora se enfrentan a una capa de costos adicional. Si un rastreador no está en la lista aprobada de Cloudflare, el desarrollador debe pagar la tarifa por uso o perder el acceso a una parte significativa de la web.
La lógica de negocio detrás de la escasez
El modelo de Cloudflare crea escasez para gestionar un mercado. Por defecto, los bots de uso mixto se bloquean en páginas llenas de anuncios, convirtiendo cada solicitud en un evento facturable. Si la empresa bloqueara todos los bots, eliminaría su propia fuente de ingresos. Por lo tanto, el bloqueo selectivo protege los beneficios y obliga a los operadores de bots a establecer una relación de pago.
El cambio también aprovecha la enorme base de usuarios del nivel gratuito de Cloudflare. Millones de sitios se registraron porque el plan gratuito ofrecía servicios de CDN y seguridad fáciles de usar. Ese acceso "gratuito" era una estrategia de adquisición de clientes, no una oferta caritativa. Ahora, esos sitios pertenecen a una red que genera ingresos para Cloudflare cuando la IA consume su contenido, pero los sitios no tienen voz ni voto en los precios o en las categorías de políticas que determinan quién recibe el pago.
Conclusión
La reestructuración de pago por uso de Cloudflare hace más que añadir una nueva línea de ingresos; le otorga a la empresa el poder de etiquetar, cobrar y, en última instancia, decidir qué rastreadores de IA pueden leer la web.
