Google ได้ปรับลดราคาโมเดล Gemini 3.7 Flash ลงถึง 50% จนถึงวันที่ 31 ธันวาคม โดยคิดค่าบริการที่ $0.75 ต่อหนึ่งล้าน input tokens และ $3.75 ต่อหนึ่งล้าน output tokens การลดราคาครั้งนี้ส่งผลกระทบโดยตรงต่อเหล่านักพัฒนาที่กำลังสร้าง AI agents ซึ่งต้นทุนที่ต่ำลงอาจเป็นตัวตัดสินใจสำคัญระหว่างการใช้งานบนแพลตฟอร์มของ Google ต่อไป หรือการย้ายไปยังคู่แข่ง
ทำไมส่วนลดนี้ถึงสำคัญในตอนนี้
Gemini 3.7 Flash เป็นตัวเลือกที่รวดเร็วและราคาประหยัดสำหรับเวิร์กโหลดที่เน้นการเขียนโค้ดและการทำงานอัตโนมัติ (automation) เป็นหลัก Google ได้เปิดเผยตัวเลข Benchmark ใหม่ที่แสดงให้เห็นว่าโมเดลนี้สามารถลดช่องว่างในงานที่เกี่ยวข้องกับ agent ได้มากขึ้น โดยคะแนน DeepSWE v1.1 เพิ่มขึ้นจาก 49.0% เป็น 65.3%, FrontierCode จาก 34.4% เป็น 43.6%, และ Zapier AutomationBench จาก 17.0% เป็น 30.4% การพัฒนาเหล่านี้มีความสำคัญต่อทีมที่ต้องรันลูปการดึงข้อมูล (data-extraction) หรือการเรียกใช้เครื่องมือ (tool-calling) ที่มีความถี่สูง ซึ่งทุกๆ token ที่ใช้จะถูกนำไปคำนวณเป็นค่าใช้จ่าย
ตลาดโมเดล AI นั้นมีการแข่งขันที่สูงมากอยู่แล้ว ทางเลือกอื่นๆ เช่น GPT-5.6 Luna, Grok 4.6 และโมเดลแบบ open-weight ต่างๆ ก็กำลังแย่งชิงส่วนแบ่งในตลาด "cheap agent" เช่นกัน การเสนอช่วงเวลาลดราคาครึ่งหนึ่งนี้ Google หวังที่จะดึงดูดให้นักพัฒนาเข้ามาอยู่ในระบบนิเวศ (ecosystem) ของตนก่อนที่ราคาจะกลับไปอยู่ที่ $1.50 ต่อหนึ่งล้าน input tokens และ $7.50 ต่อหนึ่งล้าน output tokens ในเดือนมกราคม
สิ่งที่นักพัฒนาจะได้รับ—หรือสูญเสีย
- เพิ่มอัตรากำไรในช่วงที่ยังมีส่วนลด – การลดต้นทุน token ลงครึ่งหนึ่งสามารถช่วยลดงบประมาณการดำเนินงานลงได้อย่างเห็นได้ชัด สำหรับบริการใดก็ตามที่มีการประมวลผลหลายล้าน token ต่อวัน
- ความเสี่ยงในการถูกผูกขาด (Potential lock-in) – การเปลี่ยนผู้ให้บริการมักไม่สามารถทำได้แบบ plug-and-play เนื่องจาก API ของแต่ละโมเดลมีความแตกต่างกันทั้งในด้านรูปแบบการส่งคำขอ (request format), ข้อจำกัดด้านอัตราการใช้งาน (rate limits) และฟีเจอร์ที่รองรับ การกระโดดขึ้นของราคาอย่างกะทันหันอาจบีบให้ทีมต้องแบกรับต้นทุนที่สูงขึ้น หรือต้องเสียเวลาและเงินทุนในการย้ายระบบ (migration)
- แรงกดดันด้านราคาจากการแข่งขัน – คู่แข่งอาจตอบโต้ด้วยข้อเสนอที่มีเวลาจำกัดของตนเอง ซึ่งอาจก่อให้เกิดสงครามราคาในระยะสั้น แม้ว่าอาจจะเป็นประโยชน์ต่อผู้ใช้งานปลายทาง แต่ก็อาจทำให้การวางแผนในระยะยาวขาดความเสถียร
วิธีปกป้อง pipeline ของ agent ของคุณ
- จดจำวันสิ้นสุด – ตั้งการแจ้งเตือนในปฏิทินสำหรับวันที่ 31 ธันวาคม การทราบวันที่ราคาจะกลับสู่ระดับปกติจะช่วยหลีกเลี่ยงการสูญเสียกำไรอย่างไม่คาดคิด
- ออกแบบให้สามารถสลับเปลี่ยนได้ – สร้างเลเยอร์บางๆ (thin layer) หรือไฟล์กำหนดค่า (configuration file) มาครอบการเรียกใช้งานโมเดลไว้ ตัวอย่างเช่น หากคุณเปลี่ยนจาก Gemini ไปใช้ Luna คุณควรจะทำได้เพียงแค่เปลี่ยนการตั้งค่าเท่านั้น โดยไม่ต้องเขียนโค้ดใหม่ทั้งหมด
- ทำการทดสอบ Benchmark ด้วยตัวเอง – ใช้โจทย์จากโลกความเป็นจริงเพื่อเปรียบเทียบ Gemini 3.7 Flash กับโมเดลอื่นๆ เพราะต้นทุน token เป็นเพียงส่วนหนึ่งของสมการเท่านั้น ความหน่วง (latency), ความแม่นยำ (accuracy) และความพยายามในการรวมระบบ (integration effort) ก็มีความสำคัญเช่นกัน
อีกด้านหนึ่งของข้อตกลงนี้
ส่วนลดนี้เป็นแบบชั่วคราวอย่างชัดเจน หลังจากสิ้นสุดช่วงลดราคาปลายปี นักพัฒนาจะต้องเผชิญกับราคาเต็ม ซึ่งยังคงสูงกว่าราคาที่โปรเจกต์แบบ open-weight บางแห่งโฆษณาไว้ ทีมที่สร้างการเชื่อมต่อเชิงลึก (deep integrations) กับ Gemini ไปแล้วอาจรู้สึกถึงการกระโดดของราคาได้รุนแรงกว่าทีมที่ออกแบบสถาปัตยกรรมแบบ modular ราคาที่ต่ำลงไม่ได้หมายความว่าจะให้ความคุ้มค่าโดยรวมที่ดีกว่าเสมอไป หากประสิทธิภาพของโมเดลในกรณีการใช้งานเฉพาะด้านนั้นด้อยกว่าทางเลือกอื่นที่ราคาถูกกว่า
สิ่งที่ต้องจับตามองต่อไป
- การยืนยันราคาในเดือนมกราคม – Google ได้ส่งสัญญาณว่าจะกลับไปใช้ราคาเดิม แต่การปรับเปลี่ยนหรือการขยายเวลาใดๆ จะส่งผลต่อรอบการจัดทำงบประมาณ
- โปรโมชันจากคู่แข่ง – ส่วนลดที่มีเวลาจำกัดของคู่แข่งอาจเปลี่ยนการคำนวณต้นทุนก่อนเริ่มปีใหม่
- ตัวชี้วัดการใช้งาน – อัตราการใช้งาน Gemini 3.7 Flash ในช่วงที่มีส่วนลดจะบ่งบอกว่าแพลตฟอร์มนี้มีความเหนียวแน่น (sticky) เพียงใดเมื่อราคากลับมาสูงขึ้นอีกครั้ง
บทสรุป: ช่วงเวลาลดราคาครึ่งหนึ่งช่วยให้นักพัฒนามีโอกาสทดสอบโมเดล agent ที่เร็วขึ้นและถูกลง แต่ความได้เปรียบที่แท้จริงอยู่ที่การสร้างระบบที่สามารถปรับเปลี่ยน (pivot) ได้เมื่อส่วนลดสิ้นสุดลง ความยืดหยุ่นในตอนนี้จะช่วยป้องกันความวุ่นวายที่มีต้นทุนสูงในภายหลัง
