Vercel ha añadido “AI Gateway Budgets”, un límite de gasto por proyecto y por clave de API que bloquea automáticamente las llamadas adicionales a modelos de lenguaje de gran tamaño (LLM) una vez que se alcanza un límite preestablecido. La función está diseñada para detener los costes de IA descontrolados que pueden dispararse debido a un único bucle erróneo o un error de reintento.

Por qué es importante un interruptor de apagado (kill switch) dedicado exclusivamente a la IA

Los desarrolladores que utilizan el AI Gateway de Vercel enrutan las solicitudes de LLM a través de la infraestructura de Vercel, pagando por los tokens que consumen esos modelos. Un solo bucle de inyección de prompts o una política de reintento mal configurada puede generar miles de solicitudes de tokens en cuestión de minutos, convirtiendo un presupuesto modesto en una factura de cinco cifras. Las herramientas de gestión de gastos existentes en Vercel operan a nivel de cuenta y limitan todo el tráfico saliente, no solo las llamadas de IA. Ese enfoque tan general puede paralizar el front-end o la API de un sitio, incluso cuando el uso de la IA es el único problema.

En qué se diferencian los AI Gateway Budgets de los controles de gasto estándar

  • Alcance – Los presupuestos se aplican únicamente al gasto de tokens de IA, dejando el resto de la cuenta intacta.
  • Granularidad – Los límites pueden establecerse a nivel de equipo, proyecto o clave de API individual.
  • Comportamiento – Cuando se alcanza un límite, el gateway devuelve una respuesta HTTP 402 “Payment Required”, indicando que la solicitud fue bloqueada porque el presupuesto se ha agotado.
  • Aislamiento – Un solo proyecto que alcance su límite no puede agotar la asignación restante del equipo, protegiendo a otros proyectos de daños colaterales.

Configuración de un presupuesto en cuestión de minutos

Vercel permite configurar presupuestos a través del panel de control web o mediante la interfaz de línea de comandos (CLI). La CLI es útil para la creación de scripts en múltiples entornos.

Límite para todo el equipo (mensual)

vercel ai-gateway budgets set team --limit 500 --refresh-period monthly

Límite específico por proyecto (mensual)

vercel ai-gateway budgets set project my-project --limit 200 --refresh-period monthly

Los presupuestos se acumulan, por lo que se aplica el límite más restrictivo de los dos. Si el proyecto alcanza su techo de 200 $, las solicitudes se detienen aunque al equipo todavía le queden 300 $.

Clave orientada a contratistas

vercel ai-gateway api-keys create --name contractor \
  --limit 50 --refresh-period none --expiration 30d

La clave caduca después de 30 días y se detiene tras gastar 50 $ en IA, proporcionando una ventana de acceso limpia y limitada en el tiempo para colaboradores externos.

Qué hacen realmente los límites

  • Límite flexible (Soft cap) – La solicitud que hace que el gasto supere el umbral se completa, por lo que es posible un pequeño exceso.
  • Retraso en la aplicación – Los presupuestos se evalúan una vez cada uno o dos minutos; una ráfaga de llamadas justo después de alcanzar un límite puede pasar antes de que se active el bloqueo.
  • Sin cobertura para BYOK – Si utilizas tus propias claves de proveedor de la nube (BYOK) para facturar directamente a un proveedor de LLM externo, el sistema de presupuesto de Vercel no puede ver ese tráfico, por lo que el límite no se aplica.

Cuándo destaca la función y cuándo se queda corta

El interruptor de apagado es una respuesta pragmática al problema del "choque por factura de IA" que ha perseguido a muchos equipos de SaaS. Para la mayoría de los proyectos alojados en Vercel que dependen del AI Gateway integrado, el presupuesto se puede configurar en menos de diez minutos y proporciona una red de seguridad contra gastos accidentales.

Sin embargo, la naturaleza de límite flexible significa que un pico de corta duración aún puede costar unos pocos dólares por encima del límite. Los equipos que necesiten paradas absolutas y estrictas pueden considerar que el retraso de nivel de minutos es insuficiente. Además, las empresas que enrutan el tráfico de LLM a través de sus propias credenciales de la nube deben confiar en mecanismos externos de control de costes, ya que los presupuestos de Vercel no verán ese uso.

Qué observar a continuación

  • Métricas de adopción – Los primeros comentarios de los desarrolladores indicarán si la granularidad del presupuesto resuelve los escenarios de sobrecoste más comunes.
  • Extensiones de funciones – Las solicitudes de alertas en tiempo real, intervalos de aplicación más estrictos o límites conscientes de BYOK podrían dar forma a futuras actualizaciones.
  • Respuesta de la competencia – Otras plataformas serverless podrían introducir controles de gasto similares específicos para la IA, convirtiendo el movimiento de Vercel en un estándar más amplio de la industria.

Conclusión

Los AI Gateway Budgets de Vercel ofrecen a los desarrolladores una forma rápida y por proyecto de detener el gasto de tokens de IA antes de que se convierta en una factura sorpresa. La herramienta es fácil de habilitar, funciona al nivel donde ocurren la mayoría de los incidentes de costes descontrolados y devuelve un error claro cuando se infringen los límites. Sus principales inconvenientes —un pequeño exceso, un retraso en la aplicación de nivel de minutos y la falta de visibilidad del tráfico BYOK— son transparentes, dejando que los equipos decidan si la compensación se ajusta a su tolerancia al riesgo. Para cualquiera que ejecute llamadas de LLM en Vercel, el nuevo interruptor de apagado es una salvaguarda práctica que merece la pena configurar hoy mismo.