OpenAI GPT-5.6 Sol ท้าชน Fable 5 ด้วยประสิทธิภาพที่เหนือกว่า

OpenAI ได้สร้างความสั่นสะเทือนให้กับลำดับชั้นของโมเดลระดับแนวหน้า (frontier model) อย่างเป็นทางการ ด้วยการเปิดตัว GPT-5.6 Sol ซึ่งเป็นโมเดลเรือธงที่มอบความฉลาดในระดับที่ใกล้เคียงกันแต่ใช้ต้นทุนเพียงเศษเสี้ยวเดียว ด้วยการปรับความสัมพันธ์ระหว่างประสิทธิภาพและราคาให้เหมาะสมที่สุด OpenAI กำลังสร้างมาตรฐานใหม่สำหรับเวิร์กโฟลว์แบบเอเจนต์ (agentic workflows) และการปรับใช้ในระดับองค์กร

ทุบสถิติเบนช์มาร์ก: ความโดดเด่นด้านการเขียนโค้ดและความฉลาดที่ทัดเทียม

ข้อมูลใหม่จาก Artificial Analysis แพลตฟอร์มประเมินผลอิสระ เผยให้เห็นว่า GPT-5.6 Sol (max) กำลังไล่จี้โมเดลระดับท็อปของ Anthropic อย่างกระชั้นชิด ในดัชนีความฉลาด (Intelligence Index) Sol ทำคะแนนได้ 59 คะแนน ตามหลัง Claude Fable 5 เพียงแค่คะแนนเดียวเท่านั้น ซึ่งทำให้มันอยู่เหนือยักษ์ใหญ่รายอื่นอย่าง Claude Opus 4.8 (56 คะแนน) และ GPT-5.6 Terra (55 คะแนน)

แม้ว่า Fable 5 จะยังคงมีความได้เปรียบเล็กน้อยในด้านความฉลาดทั่วไป (general intelligence) แต่ OpenAI ก็สามารถคว้าชัยชนะอย่างชัดเจนในโดเมนเฉพาะทาง ในดัชนีเอเจนต์เขียนโค้ด (Coding Agent Index) ใหม่ GPT-5.6 Sol ครองอันดับหนึ่งด้วยคะแนน 80 คะแนนเมื่อรันในสภาพแวดล้อม Codex ของ OpenAI โดยทำผลงานได้เหนือกว่าทั้ง GPT-5.6 Terra (77 คะแนน) และ Claude Fable 5 (77 คะแนน) นอกจากนี้ ในเบนช์มาร์ก AA-Briefcase ซึ่งวัดประสิทธิภาพจากงานออฟฟิศในชีวิตจริง Sol ยังทำคะแนน "Presentation Elo" ได้สูงสุดในบรรดาโมเดลทั้งหมดที่ถูกทดสอบ

พรมแดนพาเรโตใหม่: การลดต้นทุนอย่างมหาศาล

ผลกระทบที่สำคัญที่สุดของการเปิดตัว GPT-5.6 อยู่ที่ประสิทธิภาพทางเศรษฐกิจ Artificial Analysis ระบุว่า Sol "กำหนดพรมแดนพาเรโต (Pareto frontier) ใหม่ระหว่างความฉลาดเทียบกับจำนวนเอาต์พุตโทเคนต่อภารกิจ" ในขณะที่ Claude Fable 5 มีต้นทุนประมาณ $2.75 ต่อภารกิจ แต่ GPT-5.6 Sol ทำงานในระดับที่เทียบเคียงกันได้ด้วยราคาเพียง $1.04 หรือประมาณหนึ่งในสามของราคาเดิม

OpenAI ยังได้เปิดตัวระบบนิเวศแบบแบ่งระดับ (tiered ecosystem) เพื่อรองรับความซับซ้อนในระดับที่แตกต่างกัน:

  • GPT-5.6 Sol: $5 ต่อล้านอินพุตโทเคน / $30 ต่อล้านเอาต์พุตโทเคน
  • GPT-5.6 Terra: $2.50 ต่อล้านอินพุต / $15 ต่อล้านเอาต์พุต (ถูกกว่า Sol 50%)
  • GPT-5.6 Luna: $1 ต่อล้านอินพุต / $6 ต่อล้านเอาต์พุต (ถูกกว่า Sol 80%)

เพื่อลดความหน่วง (latency) และต้นทุนสำหรับเวิร์กโฟลว์ที่ทำซ้ำๆ OpenAI ได้นำค่าธรรมเนียมการเขียนแคช (cache-write fee) มาใช้ และมอบส่วนลดมหาศาลถึง 90% สำหรับการอ่านแคช (cache reads) นอกจากนี้ Sam Altman ซีอีโอของบริษัท ยังระบุว่า Sol มีประสิทธิภาพในการใช้โทเคนสูงกว่าอย่างมีนัยสำคัญ โดยใช้เอาต์พุตโทเคนน้อยลงถึง 54% สำหรับงานเขียนโค้ดแบบเอเจนต์ เมื่อเทียบกับโมเดลที่ใกล้เคียงกัน

สงครามราคาโลกที่ทวีความรุนแรงขึ้น

การเปิดตัวครั้งนี้ส่งสัญญาณถึงการเปลี่ยนแปลงเชิงกลยุทธ์ในการแข่งขันทางอาวุธ AI (AI arms race) ในขณะที่โมเดลโอเพนซอร์สจากจีน, Muse 1.1 ของ Meta และ Grok 4.5 ของ xAI กำลังกดดันอัตรากำไรให้ลดลง OpenAI จึงไม่ได้แข่งขันกันแค่เรื่องความฉลาดเพียงอย่างเดียวอีกต่อไป แต่กำลังแข่งขันกันที่เศรษฐศาสตร์ต่อหน่วย (unit economics)

ด้วยการบีบทั้งด้านประสิทธิภาพและราคาของ Anthropic ทำให้ OpenAI กำลังผลักดันให้เกิดวิวัฒนาการทั่วทั้งตลาด แม้ว่า "การแข่งขันเพื่อลดราคาลงสู่จุดต่ำสุด" (race to the bottom) นี้จะเป็นประโยชน์ต่อเหล่านักพัฒนาและผู้ก่อตั้งที่ต้องการขยายขนาดแอปพลิเคชันแบบเอเจนต์ แต่มันก็ได้สร้างภูมิทัศน์การแข่งขันที่รุนแรง ซึ่งจะเป็นตัวกำหนดว่าห้องแล็บ AI แห่งใดจะสามารถอยู่รอดได้อย่างยั่งยืนในระยะยาว

สรุปประเด็นสำคัญ

  • ความฉลาดที่ทัดเทียม: GPT-5.6 Sol มีคะแนนในดัชนีความฉลาด (Intelligence Index) ไล่เลี่ยกับ Claude Fable 5 โดยห่างกันเพียงหนึ่งคะแนน และครองความเป็นเจ้าแห่งดัชนีเอเจนต์เขียนโค้ด (Coding Agent Index) ด้วยคะแนน 80 คะแนน
  • การพลิกโฉมทางเศรษฐกิจ: Sol มอบความฉลาดระดับแนวหน้าด้วยต้นทุนเพียงหนึ่งในสามของ Fable 5 ($1.04 เทียบกับ $2.75 ต่อภารกิจ)
  • ประสิทธิภาพแบบเอเจนต์: การปรับปรุงประสิทธิภาพใหม่ๆ รวมถึงส่วนลด 90% สำหรับการอ่านแคช และการใช้เอาต์พุตโทเคนน้อยลง 54% สำหรับการเขียนโค้ด ทำให้ Sol ถูกปรับแต่งมาอย่างดีเยี่ยมสำหรับเอเจนต์อัตโนมัติ (autonomous agents)