Claude Haiku 5.5が100万トークンあたり0.10ドルに値下げ、ただし10万トークン超のプロンプトは5倍の料金に

ニュース概要
Anthropicは太平洋時間2026年10月7日午前11時8分頃にClaude Haiku 5.5をリリースし、Claude 5.5ファミリーの中で最小かつ最速のモデルとして位置づけました。10万トークンまでのプロンプトについて、小規模モデルAPIアクセスのエントリー価格を入力100万トークンあたり0.10ドル、出力0.50ドルに引き下げました。これはClaude Haiku 4.5の入力1ドル・出力5ドルという料金から約90%の値下げとなります。本モデルはAnthropic自身のプラットフォーム上ではclaude-haiku-5-5という識別子で利用でき、Amazon Web Services、Google Cloud、Microsoft Azure経由でも提供されます。
Anthropicの発表内容
Haiku 5.5は、Anthropicが2026年9月下旬にSonnet 5.5とともに本モデルを初めてプレビュー公開してから約9日後の登場です。VentureBeat、MarkTechPost、DataCamp、Unite.AIの報道によると、今回のリリースは3つの要点を中心に構成されています。すなわち、大幅に引き下げられた基本価格、Haiku 4.5からの計測性能の大きな飛躍、そして調整可能な推論負荷レベルやベータ版のコンピューター操作ツールといったエージェント向け機能です。二次的な報道では、最大100万トークンのコンテキストウィンドウと最大12万8,000トークンの出力についても言及されていますが、VentureBeatの記事ではコンテキストサイズが明記されていないため、開発者はAnthropicのドキュメントで上限を確認する必要があります。
またAnthropicは、トークン消費量や一般的なリクエストサイズの変化を考慮すると、実際のワークロードではHaiku 4.5と比較してコストが約75%削減される見込みであると述べています。これは見出しにある90%の値下げよりも小さな数字です。
料金体系の説明
Haiku 5.5はプロンプト長に応じた2段階の料金体系を採用しており、いずれも100万トークンあたりの価格です。
- 10万トークンまでのプロンプト:入力0.10ドル、出力0.50ドル、キャッシュ読み取り0.01ドル、5分間キャッシュ書き込み0.125ドル。
- 10万トークンを超えるプロンプト:入力0.50ドル、出力2.50ドル、キャッシュ読み取り0.05ドル、キャッシュ書き込み0.625ドル。
- 比較としてのClaude Haiku 4.5:入力1.00ドル、出力5.00ドル、キャッシュ読み取り0.10ドル、キャッシュ書き込み1.25ドル。
Batch APIを利用すればさらに50%割引になると報告されています。複数のアナリストは「10万トークンの罠」を指摘しています。つまり、この閾値を超えたリクエストには低い料金の5倍が請求されるため、日常的に長い文書や大規模なコードベースを送信するチームでは、見出しが示唆するほど節約できない可能性があります。VentureBeatは、ちょうど10万トークンのリクエストがどのように課金されるかは記事に記載されていないと注記しています。なおAnthropicは、Sonnet 5.5のキャッシュ読み取り料金も100万トークンあたり0.20ドルから0.10ドルへ引き下げました。
ベンチマーク結果
以下の数値はベンダーが報告したものであり、第三者による独立した再現検証は行われていません。
- ナレッジワーク評価であるGDPval-AA v2.1:Haiku 5.5は1,620点を記録。Haiku 4.5は735点、OpenAIのGPT-6 Lunaは1,437点、Sonnet 5.5は1,840点。
- AA-Briefcase v1.1:Haiku 5.5は1,578点、Haiku 4.5は614点、GPT-6 Lunaは1,336点、Sonnet 5.5は1,824点。
- コンピューター操作テストであるOSWorld 2.1(オフラインサブセット):Haiku 5.5は72.4%、Haiku 4.5は15.7%、GPT-6 Lunaは48.9%、Sonnet 5.5は83.9%。
- Terminal-Bench 4.0:最大負荷設定でのHaiku 5.5は39.2%、Haiku 4.5は0.0%、GPT-6 Lunaは16.4%、Sonnet 5.5は70.6%。中程度の負荷設定では、Haiku 5.5は約20%を記録。
- FrontierCode 1.1:高負荷設定でHaiku 5.5は46.4%、GPT-6 Lunaは42.4%、Sonnet 5.5は52.1%。
独立系アグリゲーターであるBenchLMは、Haiku 5.5に100点満点中66.3点の総合スコアを与え、追跡対象216モデル中28位にランク付けしました。このスコアは異なる算出方法を用いているため、Anthropicの表の数値と直接比較することはできません。
機能と安全対策
Haiku 5.5は調整可能な推論負荷レベルに対応しており、デフォルトは「中」に設定されています。これにより開発者は、速度やコストと推論の深さをトレードオフできます。Anthropicは本モデルを標準速度において同社最速のモデルと説明していますが、1秒あたりのトークン処理数は公表されていません。ベータ版のブラウザー操作およびコンピューター操作機能は、PythonおよびTypeScriptのSDKを通じて利用可能です。
本モデルはHaiku 4.5よりも厳格なサイバーセキュリティ制限を備えて出荷されます。ペネトレーションテストのリクエストは標準の安全対策によってブロックされますが、認証プログラムを通じて審査済みのユーザーにはより広範なアクセスが提供されます。またAnthropicは、サブスクリプションにバンドルされる月間のAPIクレジットについても言及しました。Max 5xで100ドル、Max 20xで200ドル、Teamプランでは最大500ドルを共有できます。
金融テクノロジー企業Rogoで応用AIを担当するAlex Wangは、エンタープライズワークフローにおける本モデルの役割を次のように表現しました。「十分に正確なので業務で信頼でき、しかも高速で安価なため、何度も実行できるのです。」
価格面での比較
VentureBeatの比較表には、100万トークンあたりの入力および出力料金が以下のように記載されています。ここでは価格のみを比較しており、性能は比較対象外です。
- Claude Haiku 5.5:10万トークン未満のプロンプトで入力0.10ドル、出力0.50ドル。
- GPT-6 Luna:入力0.10ドル、出力0.50ドル。入力27万2,000トークン超の場合は追加料金が発生。
- Gemini 3.5 Flash-Lite:入力0.30ドル、出力2.50ドル。
- Gemini 3.8 Flash:入力0.75ドル、出力3.75ドル。2026年12月31日までプロモーション価格。
- Grok 4.3:プロンプト20万トークン未満で入力1.25ドル、出力2.50ドル。
- Grok 4.7:プロンプト20万トークン未満で入力2.00ドル、出力6.00ドル。
- GPT-6.1 SolおよびClaude Sonnet 5.5:入力2.00ドル、出力10.00ドル。
開発者や学習者にとっての意義
小規模モデルは、AIアプリケーションにおける大量かつ反復的な処理を担います。サポートチケットの分類、文書からのフィールド抽出、リクエストのルーティング、大規模なエージェントシステム内でのサブタスク実行などです。入力100万トークンあたり0.10ドルであれば、数百トークン程度の短いリクエストを100万回実行しても数ドルしかかからず、世界中でAIを試している学生、スタートアップ、研究者にとって参入障壁が下がります。
この料金体系は、実践的なエンジニアリングの教訓も示しています。コストは単なるトークン単価だけでなく、プロンプト長、キャッシング、バッチ処理にも左右されます。開発者はプロンプトを10万トークンの閾値以下に抑え、キャッシュされたコンテキストを入力価格の10分の1で再利用し、緊急でないジョブにはバッチ処理を活用することで、新モデルの価値を最大限に引き出せます。
注意点
本レポートの数値の大部分は、Anthropicの料金ページではなく2026年10月7日および8日に公開された報道に基づくものであり、ベンチマークの数値もベンダー提供のものです。予算策定や移行の判断を行う前に、価格、制限、コンテキストウィンドウについては必ずAnthropicの公式ドキュメントで確認してください。
この記事は AIBARS 編集部が AI の支援を受けてまとめました。AI は誤ることがあるため、重要な内容は元の情報源でご確認ください。誤りを見つけたら [email protected] までご連絡ください。