Anthropic ได้เปิดตัว Claude Opus 5 เมื่อวันที่ 24 กรกฎาคม โดยขยายหน้าต่างบริบท (context window) เป็นหนึ่งล้านโทเคน ในขณะที่ยังคงราคาเดิมของ Opus 4.8 ไว้ นักพัฒนาที่สร้างเวิร์กโฟลว์อัตโนมัติควรให้ความสำคัญกับเรื่องนี้: การอัปเดตครั้งนี้ได้เพิ่มการควบคุมระดับความพยายาม (effort-level controls), ขั้นตอน "การคิด" (thinking stage) ที่บังคับใช้, การทำ prompt caching สำหรับพรอมต์สั้นๆ และความสามารถในการสลับเครื่องมือระหว่างการสนทนา ซึ่งเป็นฟีเจอร์ที่อาจเปลี่ยนรูปแบบการเชื่อมต่อ (integration patterns) และโครงสร้างต้นทุนไปอย่างสิ้นเชิง
ทำไมการอัปเกรดนี้ถึงสำคัญ
Opus 5 อ้างว่ามีความฉลาดเทียบเท่ากับเกณฑ์มาตรฐาน “Fable 5” ในราคาเพียงครึ่งเดียว ในทางปฏิบัติ โมเดลนี้สามารถจัดการอินพุตได้สูงสุดถึงหนึ่งล้านโทเคน และส่งเอาต์พุตออกมาได้สูงสุดถึง 128k โทเคน โดยไม่มีการเพิ่มค่าธรรมเนียม
ตัวปรับแต่งใหม่ที่เน้นนักพัฒนาเป็นศูนย์กลาง
การควบคุมระดับความพยายาม (Effort-level controls)
โมเดลจะตั้งค่าเริ่มต้นไว้ที่ระดับความพยายามแบบ “high” แต่มีให้เลือกถึง 5 ระดับ ได้แก่ low, medium, high, xhigh และ max โดยแต่ละระดับจะแลกเปลี่ยนระหว่างเวลาในการประมวลผลและต้นทุนกับคุณภาพของคำตอบ นักพัฒนาสามารถเริ่มงานด้วยระดับ high หากงานนั้นดูไม่ซับซ้อนก็สามารถลดระดับลงมา หรือปรับขึ้นเป็น xhigh/max เมื่อต้องเจอกับปัญหาที่ยากขึ้น
โหมดการคิดแบบบังคับ (Mandatory thinking mode)
ตอนนี้ Claude จะมีขั้นตอน "การคิด" (thinking phase) ก่อนที่จะแสดงผลลัพธ์ใดๆ ออกมา โดยขั้นตอนนี้เป็นสิ่งที่บังคับสำหรับระดับความพยายามสูงสุดสองระดับ (xhigh, max) และไม่สามารถปิดใช้งานได้
Prompt caching สำหรับพรอมต์ขนาด 512 โทเคน
ตอนนี้ prompt caching สามารถใช้งานได้กับพรอมต์ที่มีขนาดเล็กเพียง 512 โทเคน
การสลับเครื่องมือระหว่างการสนทนา (beta)
ฟีเจอร์เวอร์ชัน beta นี้ช่วยให้เซสชันของ Claude ที่กำลังดำเนินอยู่สามารถเปลี่ยนเครื่องมือภายนอกที่เรียกใช้ได้ เช่น การสลับจากโมดูลค้นหาเว็บไปเป็นการคิวรีฐานข้อมูล โดยไม่ต้องเริ่มการสนทนาใหม่
ผลกระทบต่อเวิร์กโฟลว์การเชื่อมต่อระบบ
การควบคุมที่เพิ่มเข้ามาช่วยให้วิศวกรสามารถปรับแต่งต้นทุนและประสิทธิภาพได้อย่างละเอียดมากขึ้น แต่ในขณะเดียวกันก็นำไปสู่รูปแบบความล้มเหลว (failure modes) ใหม่ๆ ด้วยเช่นกัน การบังคับใช้โหมดการคิดในระดับ xhigh/max หมายความว่าโค้ดเดิมใดๆ ที่เคยปิดการใช้เหตุผลภายใน (internal reasoning) จะเกิดข้อผิดพลาดขึ้น ส่วนการสลับเครื่องมือระหว่างการสนทนายังอยู่ในช่วง beta ดังนั้นความเสถียรจึงยังไม่ได้รับการรับประกัน
ข้อโต้แย้ง
แม้ Anthropic จะคงราคาเดิมไว้ แต่ระดับความพยายามที่สูงขึ้นจะใช้ทรัพยากรในการประมวลผล (compute) มากขึ้น
สิ่งที่ควรจับตามองต่อไป
- การอัปเดตตัวอย่าง “fast mode” ซึ่งสัญญาว่าจะให้ความหน่วง (latency) ที่ต่ำลงสำหรับงานวิจัย แต่ยังไม่เปิดให้ใช้งานทั่วไป
สำหรับนักพัฒนาที่รันไพป์ไลน์ (pipelines) ของ Claude แบบอัตโนมัติ (unattended) Opus 5 มอบชุดเครื่องมือที่สามารถรีดประสิทธิภาพความฉลาดออกมาได้มากขึ้นจากเงินทุกดอลลาร์ที่จ่ายไป—ตราบใดที่พวกเขาปรับปรุงโค้ดเพื่อรองรับขั้นตอนการคิด และทดสอบเส้นทางการทำ caching และการสลับเครื่องมือแบบใหม่
