Claude Opus 5 출시: Anthropic의 두 달 만에 네 번째 모델 공개

뉴스 요약
Anthropic은 2026년 7월 24일 금요일(태평양 표준시)에 Claude Opus 5를 공식 출시하며, 이 새로운 모델을 지금까지 출시된 모델 중 가장 성능이 뛰어나고 비용 효율적인 모델로 포지셔닝했습니다. Opus 5는 최고급 Claude Fable 5 모델의 성능에 거의 근접하면서도 토큰당 비용은 절반에 불과하다고 회사 측은 설명했습니다. 현재 Anthropic의 소비자 및 개발자 제품 전반에 걸쳐 대부분의 사용자에게 기본 모델로 설정되어 있습니다. 이는 2026년 6월에 출시된 Claude Mythos 5, Claude Fable 5, Claude Sonnet 5에 이어 두 달 만에 Anthropic이 출시한 네 번째 모델입니다.
가격 및 가용성
Claude Opus 5는 입력 토큰 백만 개당 5달러, 출력 토큰 백만 개당 25달러로, 이전 모델인 Claude Opus 4.8과 동일한 가격입니다. 이는 개발자와 기업 고객이 비용 증가 없이 상당한 성능 향상을 얻을 수 있음을 의미합니다. 비교하자면, Anthropic의 가장 성능이 뛰어난 모델인 Claude Fable 5는 토큰당 가격이 약 두 배에 달하므로, Opus 5는 높은 가격표 없이 강력한 추론 능력이 필요한 팀에게 더 경제적인 선택이 될 것입니다. 이 모델은 Claude API, AWS의 Claude Platform 및 Amazon Bedrock, Google Cloud Vertex AI를 포함한 지원되는 클라우드 파트너를 통해 즉시 사용할 수 있습니다.
벤치마크 성능
Anthropic은 Opus 4.8에서 Opus 5로의 성능 향상을 입증하기 위해 여러 독립 및 내부 벤치마크 결과를 강조했습니다.
- 멀티 파일 변경, 디버깅, 사양 기반 기능 구축과 같은 실제 소프트웨어 엔지니어링 작업을 평가하는 에이전트형 터미널 코딩 벤치마크인 FrontierBench v0.1에서 Opus 5는 최대 추론 노력으로 43.3%의 점수를 기록했습니다. 이는 Opus 4.8의 18.7%, Fable 5의 33.7%, 선도적인 경쟁 모델의 37.5%와 비교됩니다.
- 명시적인 규칙이나 목표 없이 대화형 턴 기반 환경에서 새로운 문제 해결 능력을 테스트하도록 설계된 벤치마크인 ARC-AGI-3에서 Opus 5는 30.2%에 도달했습니다. 이는 추적된 가장 가까운 경쟁 모델보다 거의 네 배 높은 수치입니다. 이 벤치마크는 암기 및 단순 패턴 매칭에 저항하도록 특별히 구성되어 있으며, 익숙하지 않은 상황을 단계별로 추론할 수 있는 모델에 보상을 제공합니다.
Anthropic은 이러한 성능 향상이 단순히 규모의 확장보다는 모델이 자체 작업을 계획하고 검증하는 방식의 개선에서 비롯되었다고 밝혔습니다.
비용과 성능 균형을 위한 새로운 "노력" 제어 기능
Opus 5의 가장 주목할 만한 추가 기능 중 하나는 사용자에게 제공되는 "노력" 설정으로, 개발자는 특정 작업 또는 프롬프트에 대해 낮은, 중간, 높은 수준의 추론 깊이 중에서 선택할 수 있습니다. 낮은 노력 설정은 더 간단한 요청을 더 빠르고 저렴하게 완료하는 반면, 높은 설정은 더 어려운 문제에 대한 계획, 자체 검사 및 반복을 위해 더 많은 컴퓨팅을 할당합니다. Anthropic은 이를 통해 개발자가 응답 속도, 비용 및 정확도 간의 균형을 세밀하게 제어할 수 있으며, 모든 요청에 대해 단일 고정 동작을 강요하지 않는다고 말했습니다.
판단 및 자체 검증
Anthropic은 Opus 5가 "자신의 작업을 검증하고 성공할 때까지 신중하게 반복하는 데 훨씬 더 강력하다"고 강조했습니다. 이는 회사가 모델이 답변을 생성한 후에만 아니라 계획 중에 자체 논리 오류를 포착하도록 훈련시킨 결과라고 설명했습니다. 실제로 이는 Opus 5가 중간 단계가 올바른지, 그리고 답변이 왜 작동하는지를 확인하는 데 추론 과정의 더 많은 부분을 소비하며, 단순히 출력을 생성하고 넘어가는 것이 아니라는 것을 의미합니다. Anthropic은 이를 더 신뢰할 수 있는 에이전트형 동작을 향한 단계로 보고 있으며, 이는 여러 단계의 코딩 프로젝트, 데이터 분석, 그리고 하나의 사소한 실수가 여러 단계에 걸쳐 누적될 수 있는 직장 자동화와 같은 작업에 유용합니다.
Anthropic의 최근 모델 로드맵에서의 맥락
Opus 5는 2026년 여름 Anthropic의 빠른 출시 주기의 일부로 등장했습니다. 6월에는 일상적인 개발 작업을 위한 속도와 지능의 균형을 목표로 하는 Claude Sonnet 5와 가장 어려운 추론 및 장기 에이전트 작업에 가장 성능이 뛰어나고 비싼 모델인 Claude Fable 5, 그리고 제한적인 연구 이니셔티브를 통해 제공되는 특수 변형 모델인 Claude Mythos 5를 출시했습니다. Opus 5가 이제 변경되지 않은 가격으로 라인업의 중간-상위 계층을 채우면서, Anthropic은 두 달 만에 전체 모델 제품군을 효과적으로 새로 고쳤으며, 이는 회사가 더 빠른 내부 학습 및 평가 주기를 반영한다고 말했습니다.
개발자 및 교육자를 위한 중요성
응용 인공 지능을 탐구하는 학생, 연구원 및 개발자에게 Opus 5의 강력한 추론 벤치마크와 변경되지 않은 가격의 조합은 운영 비용 증가 없이 더 강력한 에이전트 시스템(코딩 도우미, 자동화된 연구 도구, 다단계 작업 에이전트 포함)을 실험하는 데 대한 장벽을 낮춥니다. 새로운 노력 제어 기능은 또한 현대 언어 모델이 컴퓨팅을 정확도로 거래하도록 조정될 수 있는 구체적이고 실질적인 예를 제공하며, 이는 기계 학습 과정 및 응용 AI 엔지니어링 전반에 걸쳐 점점 더 관련성이 높아지는 개념입니다.