Anthropic ได้เปิดตัวโมเดล Claude Fable 5.1 และ Mythos 5.1 ที่หลายคนตั้งตารออย่างเป็นทางการ โดยมุ่งเป้าไปที่ความต้องการที่เพิ่มขึ้นสำหรับ AI agent ที่มีประสิทธิภาพสูงและทำงานได้อย่างรวดเร็ว การอัปเดตครั้งนี้มุ่งเน้นไปที่การลดต้นทุนการดำเนินงาน การปรับปรุงเกราะป้องกันความปลอดภัย (safety guardrails) และการเพิ่มความสามารถในการใช้เหตุผลสำหรับเวิร์กโฟลว์ที่ซับซ้อนและมีหลายขั้นตอน

การลดต้นทุนอย่างมหาศาลสำหรับ Agentic Workflows

หนึ่งในการเปลี่ยนแปลงที่สำคัญที่สุดในการเปิดตัวครั้งนี้คือโครงสร้างราคาใหม่ที่ดุดัน ซึ่งออกแบบมาสำหรับงานประเภท "agentic" หรือเวิร์กโฟลว์ที่ AI ต้องดำเนินการหลายขั้นตอนซ้ำๆ เพื่อให้บรรลุเป้าหมาย Anthropic ระบุว่า Claude Fable 5.1 โดยทั่วไปจะมีราคาถูกกว่า Fable 5 ซึ่งเป็นรุ่นก่อนหน้าถึง 25% แต่สามารถช่วยประหยัดค่าใช้จ่ายได้สูงสุดถึง 45% สำหรับการดำเนินงานแบบ agentic ที่มีความซับซ้อน

การลดต้นทุนมหาศาลนี้ทำได้โดยการปรับปรุงราคาข้อมูลที่ถูกแคชไว้ (cached data) ให้เหมาะสมที่สุด ด้วยการลดต้นทุนสำหรับข้อมูลที่ผ่านการประมวลผลและจัดเก็บไว้แล้ว Anthropic จึงทำให้การสร้าง AI agent ที่ทำงานต่อเนื่องยาวนานและใช้หน่วยความจำสูง ซึ่งต้องอาศัยการดึงบริบทซ้ำๆ (repeated context retrieval) กลายเป็นเรื่องที่คุ้มค่าในเชิงเศรษฐกิจสำหรับนักพัฒนา

ความสามารถในการเขียนโค้ดและการใช้เหตุผลที่เหนือกว่า

กลุ่มผู้ใช้งานกลุ่มแรกในอุตสาหกรรมเริ่มรายงานถึงประสิทธิภาพที่ก้าวกระโดดอย่างมีนัยสำคัญ Dan Shipper ซีอีโอของ Every ได้ยกย่อง Fable 5.1 ว่าเป็นโมเดลสำหรับการเขียนโค้ดที่แข็งแกร่งที่สุดที่มีอยู่ในปัจจุบัน โดยระบุว่าโมเดลนี้ไม่เพียงแต่ทำงานได้เร็วกว่าและใช้ token ได้อย่างมีประสิทธิภาพมากขึ้นเท่านั้น แต่ยังมีโทนการสนทนาที่เป็นธรรมชาติและคล้ายคลึงกับมนุษย์มากขึ้นอีกด้วย

การปรับปรุงนี้ไม่ได้จำกัดอยู่เพียงแค่การสร้างข้อความทั่วไป แต่ยังครอบคลุมไปถึงการตีความข้อมูลที่ละเอียดอ่อน Aaron Levie ซีอีโอของ Box ตั้งข้อสังเกตว่า AI agent ของบริษัทที่ใช้ Fable 5.1 สามารถตรวจพบความละเอียดอ่อนและความคลุมเครือในชุดข้อมูลที่โมเดล Fable 5 รุ่นก่อนหน้ามองข้ามไปอย่างสิ้นเชิง นอกจากนี้ โมเดล Mythos 5.1 ยังแสดงให้เห็นถึงประสิทธิภาพที่น่าทึ่ง โดยข้อมูลจากการทดสอบ (benchmark) บ่งชี้ว่า Mythos 5.1 ในโหมด "low reasoning" มีประสิทธิภาพเทียบเท่ากับการตั้งค่า "Max reasoning" ของรุ่นก่อนหน้า ซึ่งถือเป็นการก้าวกระโดดครั้งใหญ่ในด้านประสิทธิภาพของสถาปัตยกรรม

การปรับปรุงเกราะป้องกันและความเป็นส่วนตัวสำหรับองค์กร

Anthropic ยังกำลังจัดการกับข้อวิพากษ์วิจารณ์ที่มีมาอย่างยาวนานเกี่ยวกับตัวกรองความปลอดภัยที่ "เข้มงวดเกินไป" โดย Fable 5.1 มาพร้อมกับเกราะป้องกันที่มีความแม่นยำมากขึ้น ทำให้มีโอกาสน้อยลงที่จะเกิดผลบวกปลอม (false positives) กับคำถามทั่วไปที่ไม่มีอันตราย เช่น คำถามทางชีววิทยาพื้นฐาน แม้ว่า Mythos 5.1 จะยังคงรักษาข้อจำกัดทางชีววิทยาที่เข้มงวดไว้ แต่เป้าหมายโดยรวมคือการสร้างประสบการณ์การใช้งานที่มุ่งเน้นไปที่ประโยชน์ใช้สอยมากขึ้น

เพื่อความปลอดภัยขั้นสูงสุดสำหรับองค์กร Anthropic ได้ประกาศเปิดตัว "Enterprise Frontier Safeguards" ซึ่งจะเริ่มใช้งานในช่วงปลายฤดูใบไม้ร่วงนี้ ฟีเจอร์นี้จะช่วยให้เกิด "ความเป็นส่วนตัวอย่างสมบูรณ์" โดยอนุญาตให้ลูกค้าสามารถจัดเก็บข้อมูลไว้บนเซิร์ฟเวอร์คลาวด์ของตนเองแทนที่จะเป็นโครงสร้างพื้นฐานของ Anthropic นอกจากนี้ แม้ว่าปัจจุบันจะอนุญาตให้ Fable 5.1 ใช้ในการระบุช่องโหว่ของซอฟต์แวร์ได้แล้ว แต่ Anthropic ยังคงรักษาขอบเขตที่เข้มงวดโดยการส่งต่องานที่มีความเสี่ยงสูง เช่น การสร้าง exploit และการทดสอบเจาะระบบ (penetration testing) ไปยังโมเดล Opus ที่ทรงพลังกว่า

สรุปประเด็นสำคัญ

  • ประสิทธิภาพทางเศรษฐกิจ: Claude Fable 5.1 ช่วยลดต้นทุนสำหรับงานประเภท agentic ได้สูงสุดถึง 45% ผ่านการปรับปรุงราคาข้อมูลที่ถูกแคชไว้ให้เหมาะสมที่สุด
  • การเพิ่มประสิทธิภาพ: ผลตอบรับในช่วงแรกเน้นย้ำถึงความสามารถในการเขียนโค้ดที่เหนือกว่า การจัดการความคลุมเครือของข้อมูลได้ดีขึ้น และประสิทธิภาพในการใช้เหตุผลที่ดียิ่งขึ้น
  • ความเป็นส่วนตัวที่ดียิ่งขึ้น: Enterprise Frontier Safeguards ใหม่จะช่วยให้ธุรกิจสามารถจัดเก็บข้อมูลบนเซิร์ฟเวอร์คลาวด์ของตนเองเพื่อรับประกันความเป็นส่วนตัวอย่างสมบูรณ์