Anthropic은 7월 24일 Claude Opus 5를 출시하며, Opus 4.8의 가격을 유지하면서 컨텍스트 창을 100만 토큰으로 확장했습니다. 자동화된 워크플로우를 구축하는 개발자라면 주목해야 합니다. 이번 업데이트에는 노력 수준(effort-level) 제어, 필수적인 "thinking(사고)" 단계, 짧은 프롬프트를 위한 프롬프트 캐싱, 그리고 대화 도중 도구를 교체할 수 있는 기능이 추가되었습니다. 이러한 기능들은 통합 패턴과 비용 구조를 재편할 수 있습니다.

이번 업그레이드가 중요한 이유

Opus 5는 절반의 비용으로 "Fable 5" 벤치마크에 필적하는 지능을 제공한다고 주장합니다. 실제로 이 모델은 비용 인상 없이 최대 100만 토큰의 입력을 처리하고 최대 128k 토큰의 출력을 생성할 수 있습니다.

새로운 개발자 중심의 제어 기능

노력 수준 제어 (Effort-level controls)

모델은 기본적으로 "high" 노력 설정으로 작동하지만 low, medium, high, xhigh, max의 5단계 티어를 제공합니다. 각 티어는 연산 시간 및 비용과 답변 품질 사이의 균형을 조절합니다. 개발자는 작업을 high 노력으로 시작한 뒤, 작업이 간단하다고 판단되면 더 낮은 단계로 낮추거나, 문제가 어려울 경우 xhigh/max로 높일 수 있습니다.

필수 사고 모드 (Mandatory thinking mode)

이제 Claude는 출력을 내보내기 전에 "thinking(사고)" 단계를 거칩니다. 이 단계는 가장 높은 두 단계의 노력 티어(xhigh, max)에서 필수적으로 적용되며 끌 수 없습니다.

512토큰 프롬프트를 위한 프롬프트 캐싱

이제 512토큰만큼 작은 프롬프트에도 프롬프트 캐싱이 작동합니다.

대화 도중 도구 교체 (베타)

베타 기능인 이 기능을 통해 진행 중인 Claude 세션에서 대화를 재시작하지 않고도 호출하는 외부 도구를 변경할 수 있습니다. 예를 들어, 웹 검색 모듈을 데이터베이스 쿼리로 교체하는 식입니다.

통합 워크플로우에 미치는 영향

추가된 제어 기능은 엔지니어에게 비용과 성능에 대한 더 세밀한 조정 권한을 부여하지만, 동시에 새로운 오류 발생 가능성(failure modes)도 도입합니다. xhigh/max 단계에서 사고 모드가 필수적이므로, 내부 추론을 비활성화하도록 설계된 기존 코드는 이제 오류가 발생하게 됩니다. 대화 도중 도구 교체 기능은 아직 베타 단계이므로 안정성이 보장되지 않습니다.

반론

Anthropic은 가격을 동결했지만, 더 높은 노력 티어는 더 많은 연산 자원을 소비합니다.

향후 주목할 점

  • "fast mode" 프리뷰 업데이트: 연구 워크로드에 대해 낮은 지연 시간을 약속하지만, 아직 일반 사용자에게 제공되지는 않습니다.

Claude를 무인(unattended) 상태로 실행하는 파이프라인을 운영하는 개발자에게 Opus 5는 비용 대비 더 높은 지능을 끌어낼 수 있는 도구 상자를 제공합니다. 단, 사고 단계를 수용하도록 코드를 조정하고 새로운 캐싱 및 도구 교체 경로를 테스트해야 한다는 전제 조건이 따릅니다.