Vercel ได้เพิ่ม “AI Gateway Budgets” ซึ่งเป็นเพดานการใช้จ่ายแบบรายโปรเจกต์และราย API-key ที่จะบล็อกการเรียกใช้งาน large-language-model (LLM) โดยอัตโนมัติเมื่อถึงขีดจำกัดที่ตั้งไว้ ฟีเจอร์นี้มีไว้เพื่อหยุดค่าใช้จ่าย AI ที่พุ่งสูงเกินควบคุมซึ่งอาจเกิดขึ้นจากลูปที่ผิดพลาดหรือบั๊กในการลองใหม่ (retry bug) เพียงครั้งเดียว

ทำไมสวิตช์ตัดการทำงาน (kill switch) สำหรับ AI โดยเฉพาะจึงมีความสำคัญ

นักพัฒนาที่ใช้ Vercel’s AI Gateway จะส่งคำขอ LLM ผ่านโครงสร้างพื้นฐานของ Vercel และจ่ายเงินตามจำนวนโทเคน (tokens) ที่โมเดลเหล่านั้นใช้งาน ลูปการทำ prompt-injection เพียงครั้งเดียวหรือนโยบายการ retry ที่ตั้งค่าผิดพลาดอาจสร้างคำขอโทเคนหลายพันรายการภายในไม่กี่นาที เปลี่ยนงบประมาณเพียงเล็กน้อยให้กลายเป็นบิลหลักหมื่นเหรียญ เครื่องมือจัดการการใช้จ่ายที่มีอยู่บน Vercel ทำงานในระดับบัญชี (account level) และจะจำกัดการรับส่งข้อมูลขาออกทั้งหมด ไม่ใช่แค่การเรียกใช้งาน AI เท่านั้น แนวทางแบบเหมาเข่งนี้อาจทำให้หน้าบ้าน (front-end) หรือ API ของไซต์ใช้งานไม่ได้ แม้ว่าปัญหาจะเกิดจากการใช้งาน AI เพียงอย่างเดียวก็ตาม

AI Gateway Budgets แตกต่างจากการควบคุมการใช้จ่ายมาตรฐานอย่างไร

  • Scope (ขอบเขต) – งบประมาณจะใช้กับค่าใช้จ่ายโทเคน AI เท่านั้น โดยไม่กระทบส่วนอื่นของบัญชี
  • Granularity (ความละเอียด) – สามารถตั้งค่าขีดจำกัดได้ในระดับทีม, โปรเจกต์ หรือระดับ API-key รายบุคคล
  • Behavior (พฤติกรรม) – เมื่อถึงขีดจำกัด gateway จะส่งการตอบกลับ HTTP 402 “Payment Required” เพื่อส่งสัญญาณว่าคำขอนั้นถูกบล็อกเนื่องจากงบประมาณหมดแล้ว
  • Isolation (การแยกส่วน) – โปรเจกต์เดียวที่ใช้จนเต็มเพดานจะไม่สามารถดึงงบประมาณที่เหลือของทีมไปใช้ได้ ช่วยปกป้องโปรเจกต์อื่นๆ จากผลกระทบข้างเคียง

การตั้งค่าในไม่กี่นาที

Vercel ให้คุณกำหนดงบประมาณผ่าน web dashboard หรือ command-line interface (CLI) โดย CLI จะมีประโยชน์มากสำหรับการเขียนสคริปต์ในหลายสภาพแวดล้อม

ขีดจำกัดระดับทีม (รายเดือน)

vercel ai-gateway budgets set team --limit 500 --refresh-period monthly

ขีดจำกัดเฉพาะโปรเจกต์ (รายเดือน)

vercel ai-gateway budgets set project my-project --limit 200 --refresh-period monthly

งบประมาณจะทำงานแบบซ้อนกัน (stack) โดยจะใช้เพดานที่ต่ำกว่า หากโปรเจกต์ถึงเพดาน $200 คำขอจะหยุดลงแม้ว่าทีมจะยังเหลือเงินอีก $300 ก็ตาม

คีย์สำหรับผู้รับเหมา (Contractor-oriented key)

vercel ai-gateway api-keys create --name contractor \
  --limit 50 --refresh-period none --expiration 30d

คีย์นี้จะหมดอายุหลังจาก 30 วัน และหยุดทำงานหลังจากมีการใช้จ่าย AI ถึง $50 ซึ่งเป็นการกำหนดช่วงเวลาการเข้าถึงที่ชัดเจนสำหรับผู้ร่วมงานภายนอก

ขีดจำกัดเหล่านี้ทำงานอย่างไรในความเป็นจริง

  • Soft cap – คำขอที่ทำให้การใช้จ่ายเกินขีดจำกัดจะยังคงดำเนินการจนเสร็จสิ้น ดังนั้นจึงอาจมีการใช้จ่ายเกินไปเล็กน้อย
  • Enforcement lag – งบประมาณจะถูกประเมินทุกๆ หนึ่งหรือสองนาที การเรียกใช้งานจำนวนมากทันทีหลังจากถึงขีดจำกัดอาจหลุดรอดไปได้ก่อนที่การบล็อกจะมีผล
  • ไม่มีการครอบคลุมสำหรับ BYOK – หากคุณใช้คีย์จากผู้ให้บริการคลาวด์ของคุณเอง (BYOK) เพื่อเรียกเก็บเงินโดยตรงกับผู้ให้บริการ LLM ภายนอก ระบบงบประมาณของ Vercel จะไม่เห็นทราฟฟิกนั้น ดังนั้นเพดานการใช้จ่ายจึงไม่มีผล

เมื่อไหร่ที่ฟีเจอร์นี้โดดเด่น และเมื่อไหร่ที่ยังมีข้อจำกัด

สวิตช์ตัดการทำงานนี้เป็นคำตอบที่ใช้งานได้จริงสำหรับปัญหา “AI-bill-shock” ที่สร้างความกังวลให้กับทีม SaaS จำนวนมาก สำหรับโปรเจกต์ส่วนใหญ่ที่โฮสต์บน Vercel และพึ่งพา AI Gateway ที่มีมาให้ในตัว สามารถตั้งค่าได้ภายในไม่ถึงสิบนาที และเป็นตาข่ายรองรับความปลอดภัยจากการใช้จ่ายเกินโดยไม่ตั้งใจ

อย่างไรก็ตาม ลักษณะที่เป็น soft-cap หมายความว่าการพุ่งสูงขึ้นของยอดใช้จ่ายในช่วงเวลาสั้นๆ ยังอาจทำให้เสียเงินเกินขีดจำกัดไปไม่กี่ดอลลาร์ ทีมที่ต้องการการหยุดทำงานแบบเด็ดขาด (hard stops) อาจพบว่าความล่าช้าในระดับนาทีนั้นไม่เพียงพอ นอกจากนี้ องค์กรขนาดใหญ่ที่ส่งทราฟฟิก LLM ผ่านข้อมูลประจำตัวคลาวด์ของตนเองจะต้องพึ่งพากลไกควบคุมค่าใช้จ่ายภายนอก เนื่องจากงบประมาณของ Vercel จะไม่เห็นการใช้งานส่วนนั้น

สิ่งที่ต้องจับตามองต่อไป

  • Adoption metrics (ตัวชี้วัดการใช้งาน) – ผลตอบรับในช่วงแรกจากนักพัฒนาจะบ่งชี้ว่าความละเอียดในการกำหนดงบประมาณสามารถแก้ปัญหาการใช้จ่ายเกินที่พบบ่อยที่สุดได้หรือไม่
  • Feature extensions (การขยายฟีเจอร์) – คำเรียกร้องสำหรับระบบแจ้งเตือนแบบเรียลไทม์, ช่วงเวลาการบังคับใช้ที่เข้มงวดขึ้น หรือเพดานที่รองรับ BYOK อาจเป็นทิศทางของการอัปเดตในอนาคต
  • Competitive response (การตอบโต้จากคู่แข่ง) – แพลตฟอร์ม serverless อื่นๆ อาจนำเสนอการควบคุมการใช้จ่ายเฉพาะสำหรับ AI ที่คล้ายกัน ซึ่งจะทำให้การเคลื่อนไหวของ Vercel กลายเป็นมาตรฐานใหม่ของอุตสาหกรรม

บทสรุป

AI Gateway Budgets ของ Vercel ช่วยให้นักพัฒนาสามารถหยุดการใช้จ่ายโทเคน AI ในระดับโปรเจกต์ได้อย่างรวดเร็วก่อนที่จะบานปลายกลายเป็นใบแจ้งหนี้ที่น่าตกใจ เครื่องมือนี้เปิดใช้งานได้ง่าย ทำงานในระดับที่เกิดเหตุการณ์ค่าใช้จ่ายพุ่งสูงบ่อยที่สุด และส่งข้อผิดพลาดที่ชัดเจนเมื่อมีการละเมิดขีดจำกัด ข้อเสียหลัก ได้แก่ การใช้จ่ายเกินเล็กน้อย, ความล่าช้าในการบังคับใช้ระดับนาที และการไม่เห็นทราฟฟิก BYOK นั้นเป็นสิ่งที่โปร่งใส ซึ่งช่วยให้ทีมตัดสินใจได้เองว่าความเสี่ยงดังกล่าวคุ้มค่ากับการแลกเปลี่ยนหรือไม่ สำหรับใครก็ตามที่เรียกใช้งาน LLM บน Vercel สวิตช์ตัดการทำงานใหม่นี้เป็นมาตรการป้องกันที่ใช้งานได้จริงและควรตั้งค่าตั้งแต่วันนี้