Vercel نے "AI Gateway Budgets" کا اضافہ کیا ہے، جو کہ فی پروجیکٹ اور فی API-key اخراجات کی ایک حد (cap) ہے جو پہلے سے مقررہ حد تک پہنچنے پر خود بخود مزید large-language-model (LLM) کالز کو روک دیتی ہے۔ اس فیچر کا مقصد AI کے ان بے قابو اخراجات کو روکنا ہے جو کسی ایک غلط لوپ (loop) یا ری ٹرائی (retry) بگ کی وجہ سے اچانک بڑھ سکتے ہیں۔
ایک مخصوص AI-only kill switch کیوں اہم ہے
Vercel کے AI Gateway کا استعمال کرنے والے ڈویلپرز LLM درخواستوں کو Vercel کے انفراسٹرکچر کے ذریعے بھیجتے ہیں، اور ان ماڈلز کے ذریعے استعمال ہونے والے ٹوکنز (tokens) کے لیے ادائیگی کرتے ہیں۔ ایک ہی prompt-injection loop یا غلط طریقے سے کنفیگر شدہ retry policy منٹوں میں ہزاروں ٹوکن درخواستیں پیدا کر سکتی ہے، جس سے ایک معمولی بجٹ پانچ ہندسوں والے بل میں بدل سکتا ہے۔ Vercel پر موجود موجودہ spend-management ٹولز اکاؤنٹ کی سطح پر کام کرتے ہیں اور صرف AI کالز کے بجائے تمام outbound ٹریفک کو محدود (throttle) کر دیتے ہیں۔ یہ غیر واضح طریقہ کار ویب سائٹ کے front-end یا API کو مفلوج کر سکتا ہے، چاہے مسئلہ صرف AI کے استعمال کا ہی کیوں نہ ہو۔
AI Gateway Budgets عام خرچ کنٹرولز سے کیسے مختلف ہیں
- Scope – بجٹ صرف AI ٹوکن کے اخراجات پر لاگو ہوتے ہیں، جس سے اکاؤنٹ کے باقی حصوں پر کوئی اثر نہیں پڑتا۔
- Granularity – حدیں (Limits) ٹیم، پروجیکٹ، یا انفرادی API-key کی سطح پر مقرر کی جا سکتی ہیں۔
- Behavior – جب حد ختم ہو جاتی ہے، تو gateway ایک HTTP 402 "Payment Required" رسپانس واپس کرتا ہے، جو اس بات کا اشارہ ہے کہ بجٹ ختم ہونے کی وجہ سے درخواست کو روک دیا گیا ہے۔
- Isolation – اگر کوئی ایک پروجیکٹ اپنی حد تک پہنچ جاتا ہے، تو وہ ٹیم کے باقی ماندہ الاؤنس کو ختم نہیں کر سکتا، جس سے دوسرے پروجیکٹس کو نقصانات سے بچایا جا سکتا ہے۔
چند منٹوں میں بجٹ سیٹ اپ کرنا
Vercel آپ کو ویب ڈیش بورڈ یا command-line interface (CLI) کے ذریعے بجٹ کنفیگر کرنے کی اجازت دیتا ہے۔ CLI بہت سے ماحول (environments) میں اسکرپٹنگ کے لیے مفید ہے۔
ٹیم کے لیے حد (ماہانہ)
vercel ai-gateway budgets set team --limit 500 --refresh-period monthly
پروجیکٹ کے لیے مخصوص حد (ماہانہ)
vercel ai-gateway budgets set project my-project --limit 200 --refresh-period monthly
بجٹ ایک دوسرے پر اثر انداز ہوتے ہیں (stack کرتے ہیں)، اس لیے ان دو حدوں میں سے جو زیادہ سخت ہوگی وہی لاگو ہوگی۔ اگر پروجیکٹ اپنی $200 کی حد تک پہنچ جاتا ہے، تو درخواستیں رک جائیں گی، چاہے ٹیم کے پاس ابھی بھی $300 باقی ہوں۔
کنٹریکٹر کے لیے مخصوص کی (key)
vercel ai-gateway api-keys create --name contractor \
--limit 50 --refresh-period none --expiration 30d
یہ کی (key) 30 دنوں کے بعد ختم ہو جاتی ہے اور $50 کے AI اخراجات کے بعد رک جاتی ہے، جو بیرونی معاونین (external contributors) کے لیے ایک واضح اور وقت کے تعین والا رسائی کا دورانیہ فراہم کرتی ہے۔
یہ حدیں اصل میں کیا کرتی ہیں
- Soft cap – وہ درخواست جو اخراجات کو حد سے تجاوز کرنے پر مجبور کرتی ہے، وہ مکمل ہو جاتی ہے، اس لیے تھوڑا سا حد سے تجاوز کرنا ممکن ہے۔
- Enforcement lag – بجٹ کا جائزہ ہر ایک یا دو منٹ میں ایک بار لیا جاتا ہے؛ حد تک پہنچنے کے فوراً بعد کالز کا ایک بڑا سلسلہ بلاک فعال ہونے سے پہلے گزر سکتا ہے۔
- No coverage for BYOK – اگر آپ بیرونی LLM فراہم کنندہ کے ساتھ براہ راست بلنگ کے لیے اپنی کلاؤڈ فراہم کنندہ کی کیز (BYOK) لاتے ہیں، تو Vercel کا بجٹ سسٹم اس ٹریفک کو نہیں دیکھ سکتا، اس لیے یہ حد لاگو نہیں ہوتی۔
یہ فیچر کب بہترین کام کرتا ہے، اور کب اس میں کمی رہ جاتی ہے
یہ kill switch "AI-bill-shock" کے مسئلے کا ایک عملی حل ہے جس نے بہت سی SaaS ٹیموں کو پریشان کیا ہوا ہے۔ زیادہ تر Vercel-hosted پروجیکٹس کے لیے جو بلٹ ان AI Gateway پر انحصار کرتے ہیں، بجٹ کو دس منٹ سے بھی کم وقت میں سیٹ اپ کیا جا سکتا ہے اور یہ حادثاتی طور پر زیادہ خرچ کرنے کے خلاف ایک حفاظتی جال (safety net) فراہم کرتا ہے۔
تاہم، soft-cap کی نوعیت کا مطلب ہے کہ اخراجات میں تھوڑی دیر کے لیے ہونے والا اضافہ اب بھی حد سے چند ڈالر زیادہ ہو سکتا ہے۔ وہ ٹیمیں جنہیں مکمل طور پر سخت حد (hard stop) کی ضرورت ہے، وہ منٹ کے وقفے والے اس تاخیر (lag) کو ناکافی محسوس کر سکتی ہیں۔ مزید برآں، وہ ادارے (enterprises) جو LLM ٹریفک کو اپنے کلاؤڈ کریڈنشلز کے ذریعے بھیجتے ہیں، انہیں بیرونی لاگت کنٹرول میکانزم پر انحصار کرنا پڑے گا، کیونکہ Vercel کے بجٹ اس استعمال کو نہیں دیکھ سکیں گے۔
آگے کیا دیکھنے کو مل سکتا ہے
- Adoption metrics – ڈویلپرز سے ابتدائی فیڈ بیک سے پتہ چلے گا کہ آیا بجٹ کی یہ تفصیل (granularity) لاگت کے عام حد سے تجاوز کرنے والے حالات کو حل کرتی ہے یا نہیں۔
- Feature extensions – ریئل ٹائم الرٹس، سخت تر نفاذ کے وقفوں، یا BYOK کے لیے مخصوص حدوں کی درخواستیں مستقبل کی اپ ڈیٹس کی شکل دے سکتی ہیں۔
- Competitive response – دیگر serverless پلیٹ فارمز بھی اسی طرح کے AI-مخصوص خرچ کنٹرولز متعارف کروا سکتے ہیں، جس سے Vercel کا یہ اقدام ایک وسیع تر صنعتی معیار بن سکتا ہے۔
خلاصہ
Vercel کے AI Gateway Budgets ڈویلپرز کو ایک تیز رفتار اور فی پروجیکٹ طریقہ فراہم کرتے ہیں تاکہ AI ٹوکن کے اخراجات کو ایک غیر متوقع بل میں بدلنے سے پہلے روکا جا سکے۔ اس ٹول کو فعال کرنا آسان ہے، یہ اس سطح پر کام کرتا ہے جہاں زیادہ تر لاگت کے بے قابو ہونے کے واقعات ہوتے ہیں، اور حد کی خلاف ورزی پر ایک واضح ایرر (error) واپس کرتا ہے۔ اس کے اہم نقصانات—تھوڑا سا حد سے تجاوز، منٹ کے پیمانے پر نفاذ میں تاخیر، اور BYOK ٹریفک میں نظر نہ آنا—واضح ہیں، جس سے ٹیموں کو یہ فیصلہ کرنے کا موقع ملتا ہے کہ آیا یہ سمجھوتہ ان کے خطرے برداشت کرنے کی صلاحیت (risk tolerance) کے مطابق ہے یا نہیں۔ Vercel پر LLM کالز چلانے والے کسی بھی شخص کے لیے، یہ نیا kill switch ایک عملی حفاظتی تدبیر ہے جسے آج ہی سیٹ اپ کرنا فائدہ مند ہے۔
