Anthropic, Claude Opus 5 공개: 절반의 비용으로 누리는 최상급 성능
Anthropic이 Claude Opus 5를 공식 출시했습니다. 이 새로운 플래그십 모델은 프리미엄 모델인 Claude Fable 5와 거의 대등한 성능을 제공하면서도 가격을 대폭 낮춤으로써 하이엔드 LLM 시장의 판도를 바꾸기 위해 설계되었습니다. 이러한 전략적 행보는 GPT-5.6 Sol과 같은 경쟁사의 가격 압박을 상쇄하는 동시에, 개발자들에게 코딩 및 복잡한 지식 작업에 더 효율적인 도구를 제공하는 것을 목표로 합니다.
가성비의 한계를 깨다
Claude Opus 5의 가장 눈에 띄는 특징은 공격적인 가격 구조입니다. 최상위 모델인 Claude Fable 5의 비용이 입력 토큰 100만 개당 $10, 출력 토큰 100만 개당 $50인 반면, Opus 5는 이 가격을 절반으로 낮춰 입력 토큰 100만 개당 $5, 출력 토큰 100만 개당 $25로 책정했습니다.
지연 시간(latency) 요구 사항을 해결하기 위해 Anthropic은 처리 속도를 2.5배 높여주는 "Fast Mode"도 도입했습니다. 다만, 이 모드를 사용할 경우 토큰 가격은 두 배로 증가합니다. 이러한 계층적 가격 책정과 100만 토큰에 달하는 방대한 컨텍스트 윈도우(context window)를 결합하여, Opus 5는 Claude Max의 새로운 기본 모델이자 Claude Pro 사용자를 위한 가장 강력한 옵션으로 자리매김했습니다.
코딩 및 추론 분야의 벤치마크 압도
Opus 5는 단순히 저렴한 대안이 아닙니다. 특정 영역에서 압도적인 성능을 발휘하는 강력한 모델입니다. Frontier-Bench v0.1을 통한 에이전트 기반 터미널 코딩(agentic terminal coding)에서 Opus 5는 43.3%의 점수를 기록하며, Fable 5(33.7%)와 GPT-5.6 Sol(34.4%)을 모두 크게 앞질렀습니다. 또한 지식 작업 분야에서도 우위를 점하며 GDPval-AA v2 벤치마크에서 Elo 점수 1,861점으로 선두를 달렸습니다.
아마도 가장 놀라운 수치는 새로운 문제 해결 능력을 측정하는 ARC-AGI-3 벤치마크에서 나왔을 것입니다. Opus 5는 30.2%를 기록하며 GPT-5.6 Sol이 달성한 7.8%보다 거의 4배 높은 성적을 거두었습니다. 이는 모델이 학습 데이터 패턴을 벗어난 작업을 처리하는 능력이 비약적으로 향상되었음을 시사합니다.
지능적인 노력(Effort) 조절 및 효율성
Anthropic은 사용자가 low, medium, high, xhigh, max의 다섯 가지 설정 사이를 전환할 수 있는 정교한 "effort" 시스템을 도입했습니다. 이를 통해 토큰 소비량과 추론 깊이 사이의 세밀한 절충(trade-off)이 가능해졌습니다.
Anthropic은 비용 최적화를 위해 일반적인 작업에는 "low" 및 "medium" 설정을 권장하지만, 복잡한 에이전트 코딩에는 "xhigh"를 사용할 것을 권장합니다. 흥미롭게도, 회사는 "max" 설정에서 수익 체감(diminishing return) 현상이 나타난다고 언급했습니다. Frontier-Bench v0.1과 Artificial Analysis Coding Agent Index 모두에서 Opus 5는 비용이 더 높음에도 불구하고 최대 노력(maximum effort) 설정에서 오히려 성능이 약간 저하되는 모습을 보였습니다. 이는 현재로서는 "xhigh" 설정이 효율성 측면에서 최적의 지점(sweet spot)일 수 있음을 시사합니다.
향상된 안전성 및 자율성
사용자 피드백에 직접적으로 대응하여, Anthropic은 Opus 5를 위한 안전 분류기(safety classifiers)를 미세 조정했습니다. 모델의 사이버 필터 작동 빈도가 Fable 5보다 약 85% 감소하여, 정당한 연구를 과도하게 차단한다는 이전의 비판을 해결했습니다. 여전히 익스플로잇(exploit) 생성이나 바이너리 기반 스캐닝은 차단하지만, 소스 코드 취약점 연구에 대해서는 훨씬 더 관대해졌습니다.
또한 Opus 5는 향상된 자기 수정(self-correction) 능력을 보여줍니다. 실제 테스트에서 이 모델은 기하학적 구조를 해석하기 위해 자체적인 컴퓨터 비전 파이프라인을 작성함으로써 FreeCAD에서 3D 모델을 성공적으로 구축했습니다. 이는 다른 모든 경쟁 모델들이 해결하지 못한 작업입니다.
핵심 요약
- 획기적인 비용 절감: Opus 5는 Claude Fable 5 토큰 비용의 50%만으로 플래그십 수준의 성능을 제공합니다.
- 추론 능력의 돌파구: 새로운 문제 해결을 위한 ARC-AGI-3 벤치마크에서 경쟁 모델 대비 4배라는 압도적인 격차를 보여주었습니다.
- 최적화된 개발자 워크플로우: 향상된 안전 분류기와 특화된 "effort" 설정을 통해, Opus 5는 에이전트 코딩 및 연구를 위한 더욱 원활한 경험을 제공합니다.
