Anthropic ตัดคำสั่งใน system-prompt ออกไปถึง 80% และเปิดตัว Opus 5 ซึ่งเป็นโมเดล Claude Code ตัวใหม่ที่สามารถทำงานได้อย่างอิสระต่อเนื่องหลายวันหรือหลายสัปดาห์ และทำคะแนนได้ 30% ใน Arc AGI benchmark การออกแบบใหม่แบบ "press-delete" ซึ่งบริษัทเรียกว่ากลยุทธ์ "unhobbling" (การปลดพันธนาการ) ช่วยให้ความสามารถที่แท้จริงของ AI แสดงออกมาได้โดยไม่มีข้อจำกัดทางซอฟต์แวร์ที่มักจะกักขังโมเดลภาษาขนาดใหญ่ไว้เพียงแค่ในโหมดแชทเท่านั้น

ทำไมการเปลี่ยนแปลงนี้จึงสำคัญ

วิศวกรของ Anthropic เคยใส่ guardrails จำนวนมากให้กับ Claude ซึ่งเป็นคำสั่ง (prompts) ที่ระบุอย่างชัดเจนว่าโมเดลควรพูดอะไร ไม่ควรพูดอะไร และควรทำงานอย่างไร คำสั่งเหล่านี้ทำหน้าที่เหมือนสายจูงที่ป้องกันไม่ให้โมเดลออกนอกลู่นอกทางไปสู่พฤติกรรมที่ยังไม่ได้ทดสอบ แต่ในขณะเดียวกันก็เป็นการจำกัดความสามารถที่โมเดลจะทำได้ด้วย เมื่อ Opus 5 เปิดตัว ทีมงานได้ลบชุดคำสั่งทั้งหมดทิ้ง แล้วค่อยๆ เพิ่มคำสั่งกลับเข้าไปทีละอย่างเพื่อวัดผลกระทบ เนื่องจากโมเดลใหม่มีความสามารถสูงขึ้น พวกเขาจึงตัดข้อความเดิมส่วนใหญ่ออกไปแต่ยังคงได้ผลลัพธ์ที่เชื่อถือได้ ปัจจุบันระบบสามารถเข้าใจเป้าหมายในระดับสูงและสร้างไฟล์รวมถึงฟีเจอร์ต่างๆ ได้อย่างสมบูรณ์

ผลตอบแทนทางเทคนิค

  • ก้าวกระโดดของ Benchmark – Opus 5 ทำคะแนนได้ 30% ใน Arc AGI benchmark ซึ่งเป็นตัวชี้วัดความสามารถของโมเดลในการแก้ปัญหาใหม่ๆ ที่ไม่เคยพบมาก่อน โดย Claude เวอร์ชันก่อนหน้านี้ทำคะแนนได้ต่ำกว่านั้นมาก ซึ่งบ่งชี้ถึงการก้าวกระโดดอย่างมีนัยสำคัญของพลังในการใช้เหตุผล (reasoning power)
  • ความเป็นอิสระที่ยาวนานขึ้น – ฟีเจอร์ "Auto Mode" ช่วยให้โมเดลทำงานต่อเนื่องได้เป็นเวลานาน โดยสามารถรักษาบริบท (context) ของตัวเองและมีความคืบหน้าได้โดยไม่ต้องมีมนุษย์คอยกระตุ้นอยู่ตลอด ในทางปฏิบัติ นักพัฒนาสามารถส่งข้อกำหนด (specification) ให้โมเดลและปล่อยให้มันทำงานซ้ำๆ (iterate) ได้นานหลายวัน โดยจะเข้ามาตรวจสอบเฉพาะเมื่อถึงหลักไมล์ (milestone) ที่กำหนดไว้เท่านั้น
  • ความแข็งแกร่งต่อการโจมตีแบบ prompt injection – Prompt injection คือเทคนิคที่หลอกล่อให้โมเดลละเลยกฎความปลอดภัยโดยการฝังคำสั่งที่เป็นอันตรายไว้ในข้อมูลนำเข้าของผู้ใช้ Anthropic ระบุว่า Opus 5 สามารถต้านทานการโจมตีนี้ได้ดีกว่ารุ่นก่อนๆ เนื่องจากการวิจัยภายในและตัวจำแนกประเภท (classifiers) เฉพาะทางที่คอยตรวจจับรูปแบบที่น่าสงสัย นอกจากนี้พวกเขายังแนะนำให้กำหนดเกณฑ์การสิ้นสุดการทำงาน (exit criteria) และ guardrails ก่อนเริ่มใช้งานจริง

เดิมพันสำหรับนักพัฒนาและองค์กร

สำหรับสตาร์ทอัพที่สร้างเครื่องมือที่ขับเคลื่อนด้วย AI การเปลี่ยนแปลงนี้ช่วยขยายช่องว่างของ "product overhang" หรือช่องว่างระหว่างสิ่งที่โมเดลสามารถทำได้กับสิ่งที่ซอฟต์แวร์แวดล้อมอนุญาตให้ทำ การขจัดช่องว่างนี้ทำให้ Claude Code สามารถเปลี่ยนอินเทอร์เฟซการแชทธรรมดาให้กลายเป็นผู้ช่วยพัฒนาซอฟต์แวร์แบบ full-stack ที่สามารถเขียน ทดสอบ และปรับปรุงโครงสร้างโค้ด (refactor) ได้อย่างอิสระ ส่วนองค์กรที่นำโมเดลนี้ไปใช้จะสามารถลดเวลาที่ต้องเสียไปกับงานเขียนโค้ดที่ซ้ำซาก และช่วยให้วิศวกรมีเวลาไปทำงานด้านการออกแบบในระดับที่สูงขึ้น

"unhobbling" หมายถึงอะไรกันแน่

Cherny ใช้คำว่า "unhobbling" เพื่ออธิบายถึงการปลดปล่อยโมเดลที่มีความสามารถออกจากข้อจำกัดที่สร้างขึ้น ในผลิตภัณฑ์ AI จำนวนมาก นักพัฒนามักจะจำกัดสิ่งที่โมเดลพยายามจะทำอย่างจงใจ เพราะ UI หรือกรอบนโยบายยังไม่พร้อมรองรับขอบเขตความสามารถทั้งหมดของโมเดล ผลลัพธ์ที่ได้คือ "product overhang" ที่ซึ่ง AI ถูกวางไว้บนแท่นสูงของศักยภาพที่ไม่ได้ถูกนำมาใช้ Claude Code ช่วยดึงศักยภาพนั้นลงมาสู่การใช้งานจริง โดยให้โมเดลทำหน้าที่เป็นผู้ร่วมเขียนซอฟต์แวร์ (co-author) แทนที่จะเป็นเพียงบอทตอบคำถามเท่านั้น

คำแนะนำสำหรับผู้ก่อตั้งและนักศึกษา

  • มองหาช่องว่าง (overhang) – มองหางานที่เครื่องมือ AI ในปัจจุบันมักจะติดขัดเมื่อพ้นขีดจำกัดที่มีอยู่ งานเหล่านี้คือโอกาสทองที่แนวทางแบบ "unhobbling" จะสามารถสร้างผลตอบแทนได้อย่างมหาศาล
  • ท้าทายขีดจำกัดของโมเดล – มอบหมายงานให้ AI ที่ดูเหมือนจะเกินความสามารถที่โฆษณาไว้เพียงเล็กน้อย การใช้เหตุผลภายในของโมเดลอาจทำให้คุณประหลาดใจ โดยเฉพาะอย่างยิ่งเมื่อคุณลดแรงเสียดทานจากการใช้ prompt ลง
  • กำหนด guardrails ให้ชัดเจน – ก่อนที่จะปล่อยให้โมเดลทำงานโดยไม่มีการควบคุม ควรวางเงื่อนไขการสิ้นสุดการทำงาน (เช่น ระยะเวลาทำงานสูงสุด, การจำกัดทรัพยากร) และการตรวจสอบความปลอดภัย วิธีนี้จะช่วยให้ AI สามารถสำรวจได้ในขณะที่ยังควบคุมความเสี่ยงให้อยู่ในขอบเขต

นักศึกษาควรผสมผสานทฤษฎีเข้ากับการปฏิบัติ การเชี่ยวชาญอัลกอริทึมนั้นมีค่า แต่การนำความรู้นั้นมาควบคู่กับการคิดเชิงผลิตภัณฑ์ (product thinking) และการทดลองที่ขับเคลื่อนด้วยข้อมูล จะช่วยให้ก้าวขึ้นมาเป็นกลุ่มผู้สร้างยุคใหม่ที่ใช้ AI เป็นหลัก (AI-first builders)

สิ่งที่ต้องจับตามองต่อไป

บทสรุป: การลบ system prompts ส่วนใหญ่ออกไป ทำให้ Anthropic ปล่อยให้โมเดลที่ฉลาดกว่าทำงานได้โดยไม่ต้องมีคนคอยประคองมากนัก เปลี่ยน Claude Code ให้กลายเป็นนักเขียนโค้ดอัตโนมัติที่สามารถจัดการโปรเจกต์ที่ยาวนานหลายสัปดาห์ได้