Vercelは「AI Gateway Budgets」を追加しました。これはプロジェクトごと、またはAPIキーごとに設定できる支出上限(spend cap)で、あらかじめ設定した制限に達すると、大規模言語モデル(LLM)へのさらなる呼び出しを自動的にブロックします。この機能は、単一のバグによるループやリトライの不具合によって急増する、制御不能なAIコストを防ぐことを目的としています。

AI専用のキルスイッチが重要な理由

VercelのAI Gatewayを使用する開発者は、LLMのリクエストをVercelのインフラ経由でルーティングし、モデルが消費するトークンに対して支払いを行います。単一のプロンプトインジェクションのループや、誤設定されたリトライポリシーによって、数分間に数千ものトークンリクエストが発生し、控えめな予算が5桁(数万ドル規模)の請求に化けてしまう可能性があります。Vercelの既存の支出管理ツールはアカウントレベルで動作し、AIの呼び出しだけでなく、すべての送信トラフィックを制限(throttle)します。このような大まかなアプローチでは、AIの使用量だけが問題である場合でも、サイトのフロントエンドやAPIを麻痺させてしまう恐れがあります。

AI Gateway Budgetsと標準的な支出管理の違い

  • Scope(範囲) – 予算はAIトークンの支出にのみ適用され、アカウントの他の部分は影響を受けません。
  • Granularity(粒度) – 制限は、チーム、プロジェクト、または個別のAPIキーレベルで設定できます。
  • Behavior(動作) – 制限に達すると、ゲートウェイはHTTP 402「Payment Required」レスポンスを返し、予算が尽きたためにリクエストがブロックされたことを示します。
  • Isolation(分離) – 上限に達した単一のプロジェクトが、チームの残りの割り当てを使い果たすことはなく、他のプロジェクトを二次被害から保護します。

数分で予算を設定する

Vercelでは、ウェブダッシュボードまたはコマンドラインインターフェース(CLI)を通じて予算を設定できます。CLIは、多くの環境にわたってスクリプトを実行する場合に便利です。

チーム全体の制限(月額)

vercel ai-gateway budgets set team --limit 500 --refresh-period monthly

プロジェクト固有の制限(月額)

vercel ai-gateway budgets set project my-project --limit 200 --refresh-period monthly

予算は累積(スタック)されるため、より厳しい方の制限が適用されます。プロジェクトが200ドルの上限に達した場合、チームにまだ300ドルの残高があっても、リクエストは停止します。

外部委託者向けのキー

vercel ai-gateway api-keys create --name contractor \
  --limit 50 --refresh-period none --expiration 30d

このキーは30日後に期限切れとなり、AI支出が50ドルに達した時点で停止します。これにより、外部のコントリビューターに対して、期間を限定したクリーンなアクセス権を提供できます。

制限の実際の挙動

  • Soft cap(ソフトキャップ) – 支出を閾値以上に押し上げるリクエスト自体は完了するため、わずかな超過が発生する可能性があります。
  • Enforcement lag(適用ラグ) – 予算の評価は1〜2分に一度行われます。制限に達した直後のバースト的な呼び出しは、ブロックが有効になる前に通過してしまう可能性があります。
  • BYOKは対象外 – 外部のLLMプロバイダーに直接請求するために、独自のクラウドプロバイダーのキー(BYOK)を使用している場合、Vercelの予算システムはそのトラフィックを検知できないため、制限は適用されません。

この機能が威力を発揮する場面と、不十分な場面

このキルスイッチは、多くのSaaSチームを悩ませてきた「AI請求額のショック(AI-bill-shock)」問題に対する現実的な解決策です。組み込みのAI Gatewayに依存しているほとんどのVercelホストプロジェクトにおいて、予算設定は10分足らずで完了し、不注意な使いすぎに対するセーフティネットを提供します。

しかし、ソフトキャップという性質上、短時間のスパイクによって制限を超えて数ドル程度のコストが発生する可能性があります。絶対的なハードストップ(即時停止)を必要とするチームにとっては、数分単位のラグは不十分と感じられるかもしれません。さらに、独自のクラウド認証情報を使用してLLMトラフィックをルーティングしているエンタープライズ企業は、Vercelの予算システムがその使用量を把握できないため、外部のコスト管理メカニズムに頼る必要があります。

今後の注目点

  • 採用メトリクス – 開発者からの初期フィードバックにより、予算の粒度が最も一般的なコスト超過シナリオを解決できるかどうかが明らかになります。
  • 機能拡張 – リアルタイムアラート、より短い適用間隔、またはBYOKを考慮した制限などの要望が、今後のアップデートを形作る可能性があります。
  • 競合の反応 – 他のサーバーレスプラットフォームも同様のAI特化型支出管理を導入する可能性があり、Vercelの動きが業界全体の標準となるかもしれません。

まとめ

VercelのAI Gateway Budgetsは、AIトークンの支出が予期せぬ請求額へと膨れ上がる前に、プロジェクトごとに迅速に停止させる手段を開発者に提供します。このツールは有効化が容易で、コストの暴走が最も発生しやすいレベルで機能し、制限を超えた際には明確なエラーを返します。わずかな超過、数分単位の適用遅延、BYOKトラフィックの不可視性といった主な欠点は明白であり、そのトレードオフが自社のリスク許容度に適合するかどうかは各チームの判断に委ねられます。VercelでLLM呼び出しを行っているすべての人にとって、この新しいキルスイッチは今すぐ設定しておく価値のある実用的な保護策です。