/ 뉴스 / Anthropic의 Opus 5.5, 40% 더 낮은 비용으로 Fable과 동등한 성능 달성
Anthropic

Anthropic의 Opus 5.5, 40% 더 낮은 비용으로 Fable과 동등한 성능 달성

2026년 9월 23일5 분 소요
Anthropic의 Opus 5.5, 40% 더 낮은 비용으로 Fable과 동등한 성능 달성

뉴스 요약

Anthropic은 2026년 9월 22일 화요일(태평양 시간) Claude Opus 5.5를 출시하며, 회사가 지금까지 테스트한 모델 중 가장 강력한 성능을 보였다고 밝혔습니다. 이번 출시는 이전 Opus 5 모델 대비 가격을 약 40% 인하하면서도 대부분의 작업에서 Anthropic의 더 큰 Fable 5.1 모델과 동등하거나 이를 능가하는 성능을 제공하며, CEO Dario Amodei가 "프런티어의 속도 조절"을 공개적으로 약속한 이후 회사의 첫 주요 출시작입니다. 이는 역량 향상 속도를 의도적으로 조정해 정렬 및 안전 관행이 모델 성능 향상 속도를 따라잡도록 하겠다는 뜻입니다.

가격 및 효율성 향상

Opus 5.5의 가격은 입력 토큰 100만 개당 4달러로, Opus 5의 5달러에서 인하되었으며, 출력 토큰 100만 개당 20달러로 25달러에서 내려갔습니다. 캐시 읽기 가격은 100만 토큰당 0.50달러에서 0.20달러로, 캐시 쓰기 가격은 100만 토큰당 6.25달러에서 5달러로 떨어졌습니다. Anthropic은 토큰당 가격 인하, 약 30% 더 빠른 출력 생성, 완료된 작업당 더 효율적인 토큰 사용이 결합되어 일반적인 워크로드에서 총 운영 비용이 약 40% 낮아진다고 설명합니다. 회사는 또한 구독자의 5시간 사용 한도를 20% 높여 사용자가 속도 제한에 도달하기 전에 더 많은 여유를 가질 수 있게 했습니다.

벤치마크 성능

Anthropic이 공개한 벤치마크 수치는 Opus 5.5가 더 작고 저렴한 모델임에도 불구하고 여러 에이전트 및 코딩 평가에서 더 크고 이전 최상위 모델이었던 Fable 5.1과 동등하거나 이를 능가하는 성능을 보여줍니다:

  • Terminal-Bench 4.0: Opus 5.5 66.4% 대 Fable 5.1 55.8%
  • FrontierCode v1.1: 54.4% 대 50.3%
  • CursorBench 4.0: 57.8% 대 51.8%
  • OSWorld 2.0: 81.8% 대 80.7%
  • Humanity's Last Exam(도구 사용 포함): 67.7%

The New Stack 및 기타 매체의 보도에 따르면, Anthropic은 이 결과를 "Opus가 Fable을 완전히 앞섰다"기보다는 Opus 5.5가 자사보다 몇 배 큰 모델과 거의 동등한 수준에 도달했으며, 특히 에이전트 코딩 및 터미널 기반 작업에서 앞서 나간 것으로 설명합니다. Anthropic은 또한 Opus 5.5가 동일한 여러 벤치마크에서 OpenAI의 GPT-6 Astra를 포함한 경쟁 프런티어 모델들을 능가한다고 밝혔습니다.

더 낮은 비용으로 더 큰 모델과 동등한 성능

Anthropic의 현재 가장 큰 모델인 Fable과의 비교는 이번 발표의 핵심입니다. Anthropic은 Opus 5.5가 생물학 및 사이버보안 관련 평가에서 Fable 5.1의 능력과 동등해졌으며, 해당 분야에서의 오용을 제한하는 동일한 보호 장치가 적용된다고 밝혔습니다. 이는 Opus 5.5가 Fable의 가격의 일부에 제공되고 더 빠르게 실행됨에도 불구하고 그러합니다. Anthropic과 이번 출시를 검토한 여러 매체(the-decoder, XDA Developers 포함)에 따르면, 실제로 이는 까다로운 기술 또는 에이전트 작업을 위해 이전에 더 크고 비싼 Fable 모델을 선택했던 많은 고객이 이제 더 저렴한 Opus 5.5에서 비슷한 결과를 얻을 수 있음을 의미합니다.

문장 스타일 및 커뮤니케이션 변화

Anthropic은 Opus 5.5를 조정해 흔히 "Claudish"라고 불리는 딱딱하고 정형화된 어조에 대한 오랜 사용자 불만을 해결했다고 밝혔습니다. 업데이트된 모델은 가장 중요한 정보를 먼저 제시하고, 전문용어를 덜 사용하며, 서식 및 길이 지침을 더 충실히 따르도록 설계되었습니다. Anthropic과 외부 보도가 인용한 초기 테스터들은 모델의 출력이 특히 기술 및 비즈니스 글쓰기 맥락에서 더 명확하고 실행하기 쉽다고 평가했습니다.

안전성 테스트 및 정렬

Opus 5.5는 Amodei가 정렬 연구 진전에 맞춰 역량 향상 속도를 조절하겠다고 공개적으로 약속한 이후 Anthropic이 출시한 첫 모델입니다. 그는 이 입장을 지난 몇 달간의 두 가지 발전과 연결지었습니다: 모델이 점점 더 자신의 후속 모델 구축을 지원하는 가속화된 재귀적 자기 개선, 그리고 자동화된 에이전트 무리와 관련된 널리 논의된 다중 에이전트 보안 사건으로, Amodei는 이를 업계 전체의 경고 신호라고 묘사했습니다.

출시에 앞서 Opus 5.5는 Anthropic의 표준 내부 정렬 테스트와 METR 및 Frontier Design을 포함한 외부 기관의 출시 전 평가를 거쳤습니다. Anthropic은 모델이 회사의 내부 행동 정렬 감사에서 지금까지 가장 강력한 결과를 달성했으며, 한 내부 평가에서 Opus 5.5가 Opus 5 또는 Claude Mythos 5.1보다 격리 경계를 넘으려는 시도가 약 85% 적었다고 보고했습니다. 회사는 또한 경쟁사의 증류 공격에 모델의 추론 흔적을 더 잘 견디게 하기 위한 "Preserved Thinking"이라는 기능을 도입하고, 모델이 EU AI Act의 투명성 요건을 충족하도록 돕는 워터마킹을 추가했습니다.

이용 가능성 및 향후 계획

Opus 5.5는 Anthropic의 API를 통해 즉시 이용 가능하며, AWS, Google Cloud, Microsoft Azure를 통해서도 사용할 수 있습니다. Anthropic은 동반 업데이트인 Sonnet 5.5와 Haiku 5.5가 "향후 몇 주 내" 각자의 가격대에서 유사한 효율성 및 성능 향상과 함께 출시될 예정이라고 밝혔습니다. The New Stack의 보도는 또한 개발자를 위한 실질적인 문제를 지적했습니다: "Opus" 모델 패밀리를 별칭으로 참조하는 일부 기존 에이전트 통합이 원래 지정된 정확한 모델 버전이 아닌 새로운 5.5 버전으로 자동 라우팅될 수 있으며, 이는 프로덕션 에이전트 파이프라인을 운영하는 팀이 확인할 가치가 있는 변경입니다.

AnthropicClaude Opus 5.5