OpenAI ประกาศเมื่อวันที่ 30 กรกฎาคม 2026 ว่า GPT-5.6 API จะมีราคาถูกลงอย่างมากเมื่อเทียบกับรุ่นก่อนหน้า โดยมีการเปิดตัวโมเดลแบบแบ่งระดับสามระดับ ได้แก่ Sol, Terra และ Luna พร้อมด้วยส่วนลดจำนวนมากสำหรับการอ่านข้อมูลจากแคช (cached reads)
ทำไมราคาใหม่นี้ถึงสำคัญ
นับตั้งแต่การเปิดตัว GPT-5 ต้นทุน API ถือเป็นรายการค่าใช้จ่ายหลักสำหรับทุกคนที่สร้างเอเจนต์สนทนา (conversational agents), ไพป์ไลน์การสร้างแบบเสริมการสืบค้น (retrieval-augmented generation หรือ RAG) หรือเครื่องมือสกัดข้อมูลขนาดใหญ่ การลดค่าธรรมเนียมอินพุตลงเหลือ $5, $2 และ $0.20 ต่อล้านโทเคนสำหรับ Sol, Terra และ Luna ตามลำดับ ช่วยให้ OpenAI มอบทางเลือกที่ประหยัดกว่าให้แก่เหล่านักพัฒนาในการเลือกความสามารถในการใช้เหตุผล (reasoning) ตามที่ต้องการ โดยไม่ต้องออกแบบโครงสร้างระบบ (stack) ใหม่ทั้งหมด การประหยัดต้นทุนจะเห็นผลชัดเจนที่สุดในรุ่น Terra ซึ่งปัจจุบันมีราคาเพียง 40% ของราคาโมเดลเรือธงเดิม และ Luna ซึ่งมีราคาเพียง 4% ของเกณฑ์มาตรฐานดังกล่าว
เจาะลึกโมเดลทั้งสามรูปแบบ
| โมเดล | ราคาอินพุต (ต่อ 1 ล้านโทเคน) | ราคาเอาต์พุต (ต่อ 1 ล้านโทเคน) | การใช้งานทั่วไป |
|---|---|---|---|
| Sol | $5 | $30 | การใช้เหตุผลเชิงลึก, งานแบบ chain-of-thought |
| Terra | $2 | $12 | งานระดับโปรดักชัน, ประสิทธิภาพที่สมดุล |
| Luna | $0.20 | $1.20 | ปริมาณงานสูง, การสกัดข้อมูลหรือการจำแนกประเภทแบบง่าย |
Sol ยังคงเป็นโมเดลที่มีราคาสูงที่สุดแต่ให้ความลึกซึ้งในการใช้เหตุผลมากที่สุด Terra ถูกวางตำแหน่งให้เป็นค่าเริ่มต้นสำหรับแอปพลิเคชันส่วนใหญ่ ในขณะที่ Luna เป็นตัวเลือกสำหรับ "งานสเกลสูง" (high-scale) ที่สามารถลดทอนความลึกซึ้งลงเพื่อแลกกับต้นทุนที่ถูกลง
การทำ Caching ช่วยลดค่าใช้จ่ายลงได้มากกว่าเดิม
OpenAI ได้นำเลเยอร์การทำแคช (caching layer) มาใช้ ซึ่งจะให้ส่วนลดสำหรับการดำเนินการอ่าน (read operations) ถึง 90% โดยอัตราสำหรับอินพุตที่มาจากแคชมีดังนี้:
- Sol: $0.50 / ล้านโทเคน
- Terra: $0.20 / ล้านโทเคน
- Luna: $0.02 / ล้านโทเคน
การเขียนข้อมูลลงในแคช (Writes to the cache) จะมีราคาเป็น 1.25 เท่าของอัตราอินพุตที่เกี่ยวข้อง และข้อมูลในแคชจะต้องคงอยู่เป็นเวลาอย่างน้อย 30 นาทีก่อนที่จะถูกลบออก (evicted)
ค่าธรรมเนียมเพิ่มเติมตามความยาว Context เพื่อควบคุมการใช้งาน
ขณะนี้ API จะมีการเรียกเก็บค่าธรรมเนียมเพิ่มเติมเมื่อคำขอมีอินพุตเกิน 272K โทเคน โดยราคาพื้นฐานสำหรับอินพุตจะเพิ่มขึ้นเป็นสองเท่า และราคาเอาต์พุตจะเพิ่มขึ้น 1.5 เท่า สำหรับอัตราส่วนเกินของ Sol นั้นอยู่ที่ $10 สำหรับอินพุต และ $45 สำหรับเอาต์พุตต่อล้านโทเคน ซึ่งช่วยให้คำนวณค่าปรับสำหรับ Context ที่ยาวผิดปกติได้ง่ายขึ้น
สิ่งที่นักพัฒนาต้องเสียไป
การลดราคาครั้งนี้มาพร้อมกับข้อสังเกตสองประการที่ขาดหายไป ประการแรก คือไม่มีระดับการใช้งานฟรี (free tier) แบบถาวร ซึ่งหมายความว่าทุกคำขอจะมีค่าใช้จ่ายเกิดขึ้นไม่ว่าจะน้อยเพียงใดก็ตาม ประการที่สอง OpenAI ยังไม่ได้นำส่วนลดแบบ batch-endpoint มาใช้สำหรับ GPT-5.6 ซึ่งเป็นฟีเจอร์ที่ช่วยให้ผู้ใช้งานขนาดใหญ่ลดต้นทุนต่อการเรียกใช้งาน (per-call costs) ในเวอร์ชันก่อนหน้าได้
วิธีการควบคุมต้นทุนให้ต่ำลง
- เลือกโมเดลที่เหมาะสม: ใช้ Sol เฉพาะกับงานที่ต้องการการใช้เหตุผลเชิงลึกอย่างแท้จริงเท่านั้น; ใช้ Terra เป็นค่าเริ่มต้นสำหรับงานโปรดักชันส่วนใหญ่; และสำรอง Luna ไว้สำหรับงานที่มีปริมาณงานสูงแต่มีความซับซ้อนต่ำ
- ใช้การทำ Caching: จัดเก็บ prompt และผลลัพธ์ระหว่างทาง (intermediate results) ที่มีการนำกลับมาใช้ซ้ำในการเรียกใช้งานครั้งต่อๆ ไป ส่วนลดการอ่าน 90% อาจช่วยประหยัดได้มากกว่าการลดราคาพื้นฐานเสียอีก
- ระวังความยาว Context: แบ่งอินพุตที่ยาวมากออกเป็นส่วนย่อยๆ หรือตัดส่วนที่ไม่จำเป็นออก เพื่อหลีกเลี่ยงค่าธรรมเนียมอินพุตที่เพิ่มขึ้น 2 เท่า
- ตรวจสอบระยะเวลาของแคช: ระยะเวลาขั้นต่ำของแคชคือ 30 นาที
ขั้นตอนต่อไป
นักพัฒนาควรคอยติดตามหน้าการกำหนดราคาอย่างเป็นทางการสำหรับการปรับเปลี่ยนใดๆ โดยเฉพาะอย่างยิ่งในส่วนของค่าธรรมเนียมการเขียนแคช (cache-write fees) หรือเกณฑ์ความยาว Context (context-length thresholds)
สรุปสาระสำคัญ: การกำหนดราคาแบบแบ่งระดับและส่วนลดการทำแคชที่ดุดันของ GPT-5.6 ทำให้มันเป็นโมเดลของ OpenAI ที่ราคาจับต้องได้ แต่การขาดระดับการใช้งานฟรีและส่วนลดแบบ batch หมายความว่าการบริหารจัดการต้นทุนอย่างชาญฉลาดจะยังคงเป็นสิ่งจำเป็นสำหรับการใช้งานในระดับขนาดใหญ่
