홈 / 뉴스 / Claude Haiku 5.5, 100만 토큰당 0.10달러로 인하… 단 10만 토큰 초과 프롬프트는 5배 비싸
Anthropic

Claude Haiku 5.5, 100만 토큰당 0.10달러로 인하… 단 10만 토큰 초과 프롬프트는 5배 비싸

2026년 10월 8일5 분 소요
Claude Haiku 5.5, 100만 토큰당 0.10달러로 인하… 단 10만 토큰 초과 프롬프트는 5배 비싸

뉴스 요약

Anthropic은 태평양 표준시 2026년 10월 7일 오전 11시 8분경 Claude Haiku 5.5를 출시하며, 이를 Claude 5.5 제품군 중 가장 작고 빠른 모델로 포지셔닝했습니다. 또한 10만 토큰 이하의 프롬프트에 대해 소형 모델 API 접근 비용을 입력 100만 토큰당 0.10달러, 출력 100만 토큰당 0.50달러로 대폭 인하했습니다. 이는 Claude Haiku 4.5의 1달러 및 5달러 요금보다 약 90% 낮은 수준입니다. 해당 모델은 Anthropic 자체 플랫폼과 Amazon Web Services, Google Cloud, Microsoft Azure에서 claude-haiku-5-5 식별자로 이용할 수 있습니다.

Anthropic의 발표 내용

Haiku 5.5는 Anthropic이 2026년 9월 말 Sonnet 5.5와 함께 이 모델을 처음 미리 공개한 지 약 9일 만에 출시되었습니다. VentureBeat, MarkTechPost, DataCamp, Unite.AI의 보도에 따르면 이번 출시는 크게 세 가지 핵심을 중심으로 이루어졌습니다. 훨씬 낮아진 기본 가격, Haiku 4.5 대비 측정된 성능의 대폭 향상, 그리고 조절 가능한 노력 수준 및 베타 컴퓨터 사용 도구와 같은 에이전트 중심 기능입니다. 부차적인 보도에서는 최대 100만 토큰의 컨텍스트 창과 최대 12만 8천 토큰의 출력을 지원한다고 전했으나, VentureBeat 기사에는 컨텍스트 크기가 명시되어 있지 않으므로 개발자는 Anthropic 문서에서 제한 사항을 직접 확인해야 합니다.

또한 Anthropic은 토큰 소비량 변화와 일반적인 요청 크기를 고려할 때, 실제 워크로드 비용이 Haiku 4.5 대비 약 75% 절감될 것으로 예상된다고 밝혔습니다. 이는 헤드라인에 나온 90% 가격 인하보다는 작은 수치입니다.

가격 체계 설명

Haiku 5.5는 프롬프트 길이에 따라 두 가지 가격 체계를 적용하며, 100만 토큰 단위로 요금이 책정됩니다.

  • 10만 토큰 이하 프롬프트: 입력 0.10달러, 출력 0.50달러, 캐시 읽기 0.01달러, 5분 캐시 쓰기 0.125달러.
  • 10만 토큰 초과 프롬프트: 입력 0.50달러, 출력 2.50달러, 캐시 읽기 0.05달러, 캐시 쓰기 0.625달러.
  • 비교 대상인 Claude Haiku 4.5: 입력 1.00달러, 출력 5.00달러, 캐시 읽기 0.10달러, 캐시 쓰기 1.25달러.

Batch API를 사용하면 여기서 추가로 50% 할인이 적용되는 것으로 알려졌습니다. 여러 분석가는 "10만 토큰 함정"을 지적했습니다. 기준치를 넘는 요청은 낮은 요율의 5배로 청구되므로, 긴 문서나 대규모 코드베이스를 정기적으로 전송하는 팀은 헤드라인이 시사하는 것보다 훨씬 적은 비용 절감 효과를 볼 수 있습니다. VentureBeat는 자사 기사에서 정확히 10만 토큰짜리 요청이 어떻게 청구되는지는 언급하지 않았다고 덧붙였습니다. Anthropic은 또한 Sonnet 5.5의 캐시 읽기 요금을 100만 토큰당 0.20달러에서 0.10달러로 인하했습니다.

벤치마크 결과

아래 수치는 벤더가 발표한 자료이며 독립적으로 재현되지 않았습니다.

  • 지식 작업 평가 도구인 GDPval-AA v2.1: Haiku 5.5는 1,620점을 기록했으며, Haiku 4.5는 735점, OpenAI의 GPT-6 Luna는 1,437점, Sonnet 5.5는 1,840점이었습니다.
  • AA-Briefcase v1.1: Haiku 5.5 1,578점, Haiku 4.5 614점, GPT-6 Luna 1,336점, Sonnet 5.5 1,824점.
  • 컴퓨터 조작 테스트인 OSWorld 2.1(오프라인 하위 집합): Haiku 5.5 72.4%, Haiku 4.5 15.7%, GPT-6 Luna 48.9%, Sonnet 5.5 83.9%.
  • Terminal-Bench 4.0: 최고 노력 수준에서 Haiku 5.5 39.2%, Haiku 4.5 0.0%, GPT-6 Luna 16.4%, Sonnet 5.5 70.6%. 중간 노력 수준에서 Haiku 5.5는 약 20%를 기록했습니다.
  • FrontierCode 1.1: 높은 노력 수준에서 Haiku 5.5 46.4%, GPT-6 Luna 42.4%, Sonnet 5.5 52.1%.

독립 집계 서비스인 BenchLM은 Haiku 5.5에 100점 만점에 66.3점의 종합 점수를 부여하여, 추적 중인 216개 모델 중 28위로 평가했습니다. 이 점수는 다른 방법론을 사용하므로 Anthropic의 표와 직접 비교할 수는 없습니다.

기능 및 안전장치

Haiku 5.5는 조절 가능한 노력 수준을 지원하며 기본값은 '중간'으로 설정되어 있어, 개발자가 추론의 깊이와 속도 및 비용 간의 균형을 맞출 수 있습니다. Anthropic은 이를 표준 속도에서 가장 빠른 모델이라고 설명했지만, 초당 토큰 처리량 수치는 공개하지 않았습니다. 베타 브라우저 및 컴퓨터 조작 기능은 Python 및 TypeScript SDK를 통해 제공됩니다.

이 모델은 Haiku 4.5보다 강화된 사이버 보안 제한 사항과 함께 출시됩니다. 표준 안전장치 하에서는 모의 해킹 요청이 차단되며, 인증 프로그램을 거친 사용자에게는 더 넓은 접근 권한이 제공됩니다. Anthropic은 구독에 포함된 월간 API 크레딧도 언급했습니다. Max 5x 플랜은 100달러, Max 20x 플랜은 200달러, Team 플랜은 최대 500달러를 공유합니다.

금융 기술 기업 Rogo의 응용 AI 담당자인 Alex Wang은 엔터프라이즈 워크플로우에서 이 모델의 역할을 다음과 같이 설명했습니다. "우리가 그곳에 맡길 만큼 충분히 정확하고, 많이 실행할 수 있을 만큼 빠르고 저렴합니다."

가격 경쟁력 비교

VentureBeat의 비교표에는 100만 토큰당 다음 입력 및 출력 요금이 나열되어 있습니다. 이 표는 성능이 아닌 가격만 비교합니다.

  • Claude Haiku 5.5: 10만 토큰 미만 프롬프트 기준 입력 0.10달러, 출력 0.50달러.
  • GPT-6 Luna: 입력 0.10달러, 출력 0.50달러 (입력 27만 2천 토큰 초과 시 추가 요금 발생).
  • Gemini 3.5 Flash-Lite: 입력 0.30달러, 출력 2.50달러.
  • Gemini 3.8 Flash: 입력 0.75달러, 출력 3.75달러 (2026년 12월 31일까지 프로모션 가격).
  • Grok 4.3: 20만 토큰 미만 프롬프트 기준 입력 1.25달러, 출력 2.50달러.
  • Grok 4.7: 20만 토큰 미만 프롬프트 기준 입력 2.00달러, 출력 6.00달러.
  • GPT-6.1 Sol 및 Claude Sonnet 5.5: 입력 2.00달러, 출력 10.00달러.

개발자와 학습자에게 중요한 이유

소형 모델은 AI 애플리케이션의 대량 반복 작업을 처리합니다. 예를 들어 지원 티켓 분류, 문서 필드 추출, 요청 라우팅, 대규모 에이전트 시스템 내 하위 작업 실행 등이 있습니다. 입력 100만 토큰당 0.10달러라면, 수백 토큰 분량의 짧은 요청 100만 건을 처리해도 비용은 몇 달러에 불과하므로 전 세계 학생, 스타트업, 연구진이 AI를 실험하는 데 드는 진입 장벽이 낮아집니다.

이번 가격 구조는 실용적인 엔지니어링 교훈도 보여줍니다. 비용은 단순히 토큰당 단가에 의존하는 것이 아니라 프롬프트 길이, 캐싱, 배치 처리에 따라 달라집니다. 개발자는 프롬프트를 10만 토큰 미만으로 유지하고, 입력 가격의 10분의 1 수준으로 캐시된 컨텍스트를 재사용하며, 긴급하지 않은 작업에는 배치 처리를 활용함으로써 새 모델의 이점을 극대화할 수 있습니다.

유의사항

이 보고서의 대부분의 수치는 Anthropic의 가격 페이지가 아닌 2026년 10월 7일과 8일에 게재된 보도에서 발췌했으며, 벤치마크 수치는 벤더가 제공한 것입니다. 예산 편성이나 마이그레이션을 결정하기 전에 가격, 제한 사항, 컨텍스트 창은 반드시 Anthropic 공식 문서를 통해 확인해야 합니다.

이 기사는 AIBARS 편집팀이 AI의 도움을 받아 정리했습니다. AI는 실수할 수 있으니 중요한 내용은 원문 출처를 확인해 주세요. 오류를 발견하셨나요? [email protected]으로 알려 주세요.

AnthropicClaude