2026년 7월 24일 Claude Opus 5를 출시했으며

표준 토큰 가격의 변동 없이 성능만 높인 구성이다. 2026년 7월 24일 출시된 Claude Opus 5는 기존 Opus 4.8와 동일한 표준 토큰 가격을 적용하여 사용자가 비용 부담 없이 모델을 업그레이드할 수 있게 한다. 해당 모델은 Claude 제품군 전반과 Claude API를 통해 제공된다. API 개발자는 모델 ID `claude-opus-5`를 사용하여 시스템에 호출할 수 있다. 가격 체계를 그대로 유지하면서 성능을 높여 기존 사용자에게 직접적인 가치 상승을 제공하는 구조를 취했다.

속도를 2.5배 높인 Fast mode는 비용 구조가 다르다. 기본 요금의 2배를 지불해야 하므로 도입 시 별도의 예산 관리가 필요하다. 지연 시간(latency) 단축이 비즈니스 가치를 가지는 인터랙티브 에이전트나 긴급 디버깅 등의 작업에 사용하도록 권장된다. 반면 백그라운드 작업에 기본값으로 설정할 경우 비용 부담이 커질 수 있다. 작업의 성격에 따라 기본 요금제와 Fast mode 사이의 선택이 필요하며, 특히 운영 비용 최적화를 위해 기본값 설정 여부를 신중히 결정해야 한다.

기술이 실제로 작동하는 방식

작업당 비용을 절반 수준으로 낮추면서도 Fable 5의 최고 성능에 근접한 수치가 확인됐다. CursorBench 3.2(코드 작성 능력을 측정하는 지표)에서 Claude Opus 5는 최대 노력 설정 시 Fable 5 최고 점수의 0.5% 이내 성능을 기록했다. 작업당 비용은 약 절반 수준으로 집계되어 경제성을 확보했다. OSWorld 2.0(운영체제 제어 능력을 평가하는 지표)에서는 Fable 5의 최고점보다 더 나은 결과를 달성했다. 이때 소요 비용은 Fable 5의 3분의 1 수준에 불과하다. 특정 벤치마크 환경에서 성능 우위와 비용 절감을 동시에 실현한 수치다.

안전 분류기에 의해 플래그가 지정된 요청을 Opus 4.8로 보내는 자동 폴백(오류나 제약 발생 시 대체 모델로 전환하는 기능) 기능이 베타 출시됐다. Anthropic은 안전성 및 보안 워크플로우 관리를 위해 요청을 다른 모델로 라우팅하는 체계를 구축했다. 이 기능은 Claude.ai, Claude Code, Claude Cowork 제품에 기본적으로 적용되어 실시간으로 작동한다. 안전 분류기가 특정 요청을 플래그로 지정하면 시스템이 즉시 Opus 4.8로 경로를 변경해 처리를 이어간다. 모델 간 자동 전환을 통해 보안 요구사항을 충족하면서 서비스 연속성을 유지하는 방식이다.

확인해야 할 핵심 지점

법률 워크플로우 평가에서 최대 추론(maximum reasoning)을 적용한 결과, 생성 토큰 사용량이 Opus 4.8 대비 26% 감소했다. 모델이 어려운 작업을 더 적은 턴 수로 종결하거나 도구 호출 횟수를 줄이고, 실패한 에이전트 루프를 방지하며 효율을 높인 결과다. 토큰당 단가가 동일하게 유지되더라도 작업 효율성이 개선되면 실질적인 운영 비용은 낮아질 수 있다.

AI Pricing Guru Labs(AI 가격 책정 전문 연구소)는 추론, 추출, 코딩, 가격 책정 등 49개 작업에서 Claude Opus 5를 테스트했다. API 오류 없이 49/49점을 기록하며 Opus 4.8와 동일한 정확도를 보였다. 다만 완료 토큰은 1,989개로 Opus 4.8의 630개보다 많았다. 리스트 가격은 동일하지만 답변이 더 장황해지면서 실제 실행 비용은 더 높게 측정되었다.

모델 선택의 기준은 토큰당 단가가 아니라 총 입력 및 캐시 입력 토큰, 출력 토큰, 재시도 횟수, 도구 호출 수, 소요 시간, 인간 수정 횟수를 모두 합산한 최종 작업 성공까지의 총 비용(Cost per accepted result)이어야 한다.