ชิป Jalapeño สำหรับการประมวลผล (inference chip) รุ่นใหม่ของ OpenAI ทำผลงานได้เหนือกว่า Blackwell ของ Nvidia ในการทดสอบ InferenceX benchmark โดยสามารถประมวลผลงาน AI ต่อวัตต์ได้มากกว่าถึง 1.5 ถึง 1.9 เท่า และมีความหน่วง (latency) ที่ต่ำกว่าอย่างเห็นได้ชัด ผลลัพธ์นี้มีความสำคัญเพราะอาจช่วยลดต้นทุนการดำเนินงานของบริการโมเดลภาษาขนาดใหญ่ และสร้างแรงกดดันต่อการครองตลาดตัวเร่งความเร็ว AI (AI accelerators) ของ Nvidia
ทำไมชิปนี้ถึงมีความสำคัญ
OpenAI เปิดตัว Jalapeño ในงานประชุม Hot Chips 2026 และเน้นย้ำถึงความร่วมมือกับ Broadcom ในการผลิตซิลิคอน ผู้ออกแบบมุ่งเป้าไปที่จุดที่ไม่มีประสิทธิภาพมากที่สุดในกระบวนการประมวลผล (inference pipelines) ในปัจจุบัน นั่นคือการเคลื่อนย้ายข้อมูลในช่วงขั้นตอน prefill และการสื่อสารระหว่างหน่วยประมวลผล (compute units) ด้วยการเก็บ key-value (KV) cache ไว้ในพื้นที่ใกล้เคียง Jalapeño จึงช่วยลดเวลาที่ต้องใช้ในการสลับเปลี่ยน tensors ซึ่งช่วยให้การสร้าง token รวดเร็วขึ้นและประหยัดพลังงานมากขึ้น
ตัวเลขที่โดดเด่น
- งาน AI ต่อวัตต์: สูงกว่า Blackwell ถึง 1.5 ถึง 1.9 เท่า ณ อัตราการประมวลผลสูงสุด (peak throughput)
- ความหน่วง (Latency): ต่ำกว่า 1.7 ถึง 3.6 เท่า ทำให้ผู้ใช้งานแบบโต้ตอบได้รับคำตอบเร็วขึ้น
- ประสิทธิภาพการทำงานแบบโต้ตอบ (Interactive workload performance): สูงกว่า 2.1 ถึง 4.1 เท่า ซึ่งเป็นผลประโยชน์ที่ส่งผลโดยตรงต่อแอปพลิเคชันในรูปแบบแชท
ผลลัพธ์เหล่านี้ปรากฏในการทดสอบ InferenceX benchmark ซึ่ง Jalapeño ยังสามารถเอาชนะชิปตระกูล Rubin ที่กำลังจะมาถึงของ Nvidia ได้อีกด้วย
ผลกระทบทางธุรกิจ
OpenAI กำลังใช้ประโยชน์จากประสิทธิภาพที่เพิ่มขึ้นนี้เพื่อลดราคา API GPT-5.6 Sol โดยมอบส่วนลดตั้งแต่ 20% ถึง 33% เมื่อเทียบกับอัตราเดิม การใช้พลังงานที่ต่ำลงช่วยลดต้นทุนในการรันคลัสเตอร์การประมวลผล (inference clusters) ขนาดใหญ่ ซึ่งเป็นส่วนต่างที่นักพัฒนาและองค์กรต่างๆ จะได้รับประโยชน์อย่างชัดเจน
จังหวะเวลาและแรงกดดันจากการแข่งขัน
Jalapeño จะเริ่มส่งมอบในปริมาณจำกัดภายในสิ้นปี 2026 และมีกำหนดการผลิตจำนวนมากในปี 2027 ซึ่งเมื่อถึงเวลานั้น Nvidia คาดว่าจะมี GPU รุ่นใหม่กว่าออกมา ซึ่งอาจช่วยลดช่องว่างนี้ลงได้ การทยอยเปิดตัวอย่างเป็นขั้นตอนบีบให้ OpenAI ต้องพิสูจน์ให้เห็นถึงประโยชน์ในการใช้งานจริง ก่อนที่คู่แข่งจะเปิดตัวซิลิคอนรุ่นใหม่
มุมมองต่าง
Nvidia น่าจะมีชิปรุ่นใหม่กว่าวางจำหน่ายในตลาดภายในเวลานั้น
สิ่งที่ต้องจับตามอง
- ข้อมูลการใช้งานจริง: ผลตอบรับจากลูกค้าในช่วงแรกเกี่ยวกับความหน่วงและการประหยัดพลังงาน จะเป็นตัวบ่งชี้ว่าตัวเลขจากการทดสอบ benchmark นั้นสามารถรักษาประสิทธิภาพไว้ได้จริงในการใช้งานจริงหรือไม่
- กลยุทธ์ด้านราคา: การลดราคา API อย่างต่อเนื่องอาจผลักดันให้ผู้ให้บริการรายอื่นต้องหันไปใช้ฮาร์ดแวร์ที่คล้ายกัน หรือเสี่ยงที่จะสูญเสียส่วนแบ่งการตลาด
- แผนงาน (roadmap) ของ Nvidia: การประกาศเปิดตัวตัวเร่งความเร็วที่เน้นการประมวลผล (inference-focused accelerator) รุ่นใหม่ จะส่งผลต่อพลวัตการแข่งขันในตลาด
แนวทางแบบ full-stack ของ OpenAI ซึ่งเป็นการสร้างทั้งโมเดล, ชิป และหน่วยความจำไปพร้อมๆ กัน ทำให้บริษัทมีข้อได้เปรียบที่ตัวเร่งความเร็วมาตรฐานไม่มี การที่ข้อได้เปรียบนี้จะกลายเป็นการเปลี่ยนแปลงตลาดที่ยั่งยืนหรือไม่นั้น ขึ้นอยู่กับว่าชิป Jalapeño จะสามารถเปลี่ยนจากตัวต้นแบบไปสู่การใช้งานอย่างแพร่หลายได้รวดเร็วเพียงใด และ Nvidia จะตอบโต้ความท้าทายด้านประสิทธิภาพนี้อย่างไร
