AnthropicのOpus 5.5、Fableと同等の性能を40%低いコストで実現

ニュース概要
Anthropicは2026年9月22日火曜日(太平洋時間)にClaude Opus 5.5をリリースし、同社がこれまでにテストした中で最も高い性能を発揮するモデルだと述べている。このリリースでは、以前のOpus 5モデルと比べて価格が約40%削減され、ほとんどのタスクでAnthropicのより大型のFable 5.1モデルと同等かそれを上回る性能を実現している。また、CEOのDario Amodeiが「フロンティアの歩調を合わせる」こと、つまり能力向上の速度を意図的に調整し、アラインメントと安全性の実践がモデルの能力に追いつくようにすることを公に約束して以来、同社初の主要リリースとなる。
価格と効率性の向上
Opus 5.5の価格は、入力トークン100万個あたり4ドルで、Opus 5の5ドルから値下げされ、出力トークン100万個あたり20ドルで、25ドルから値下げされた。キャッシュ読み取り価格は100万トークンあたり0.50ドルから0.20ドルに下がり、キャッシュ書き込み価格は100万トークンあたり6.25ドルから5ドルに下がる。Anthropicによると、トークンあたりの価格の低下、出力生成速度の約30%向上、完了したタスクあたりのトークン使用効率の改善を合わせた効果により、一般的なワークロードでの総運用コストが約40%削減されるという。同社はまた、加入者の5時間あたりの使用制限を20%引き上げ、レート上限に達するまでの余裕をユーザーに与えている。
ベンチマーク性能
Anthropicが公開したベンチマーク数値によると、Opus 5.5は、より大型で以前は最上位だったFable 5.1モデルと比べて、いくつかのエージェント型およびコーディング評価で同等かそれを上回る結果を示している。ただし、Opus 5.5は2つのうち小型で安価な方である。
- Terminal-Bench 4.0:Opus 5.5が66.4%、Fable 5.1が55.8%
- FrontierCode v1.1:54.4%対50.3%
- CursorBench 4.0:57.8%対51.8%
- OSWorld 2.0:81.8%対80.7%
- Humanity's Last Exam(ツール使用あり):67.7%
The New Stackなどの報道によると、Anthropicはこの結果を「OpusがFableを完全に超えた」というよりも、Opus 5.5が数倍の規模のモデルとほぼ同等の性能に達し、特にエージェント型コーディングとターミナルベースのタスクで先行したものだと位置づけている。Anthropicはまた、Opus 5.5が同じベンチマークのいくつかで、OpenAIのGPT-6 Astraを含む競合のフロンティアモデルを上回ると述べている。
より大型のモデルを低コストで同等に
Anthropicの現在最大のモデルであるFableとの比較は、この発表の中心にある。Anthropicによると、Opus 5.5は生物学およびサイバーセキュリティ関連の評価でFable 5.1の能力と同等になり、これらの分野での悪用を制限する同じ保護措置が適用されている。ただし、Opus 5.5はFableの価格のほんの一部で提供され、より高速に動作する。実際には、要求の厳しい技術的またはエージェント型の作業のために以前はより大型で高価なFableモデルを選んでいた多くの顧客が、より安価なOpus 5.5から同等の結果を得られるようになったと、Anthropicおよびthe-decoderやXDA Developersを含むこのリリースをレビューした複数の報道機関は述べている。
文章スタイルとコミュニケーションの変更
Anthropicによると、Opus 5.5は、しばしば「Claudish」と呼ばれる不自然で型通りの口調に関する長年のユーザーの不満に対処するよう調整されている。更新されたモデルは、最も重要な情報を最初に提示し、専門用語を減らし、書式と長さの指示により忠実に従うように設計されている。Anthropicや外部報道が引用した初期のテスターは、特に技術文書やビジネス文書の文脈で、モデルの出力がより明確で行動に移しやすくなったと述べている。
安全性テストとアラインメント
Opus 5.5は、Amodeiが能力の向上をアラインメントの進歩と歩調を合わせることを公に約束して以来、Anthropicが初めて出荷したモデルである。この立場は、彼がそれまでの数か月間の2つの進展に関連付けていた。1つは加速する再帰的自己改善であり、モデルが自らの後継の構築をますます支援するようになっている。もう1つは、自動化されたエージェントの群れが関与する広く議論されたマルチエージェントのセキュリティ事故であり、Amodeiはこれを業界全体への警告サインだと述べた。
リリースに先立ち、Opus 5.5はAnthropicの標準的な内部アラインメントテストに加え、METRやFrontier Designを含む外部組織によるリリース前評価を受けた。Anthropicは、このモデルが同社の内部行動アラインメント監査でこれまでで最も強い結果を達成し、ある内部評価では、Opus 5.5が封じ込め境界を越えようと試みた回数がOpus 5やClaude Mythos 5.1のいずれよりも約85%少なかったと報告した。同社はまた、モデルの推論トレースを競合他社による蒸留攻撃に対してより耐性のあるものにすることを目的とした「Preserved Thinking」と呼ばれる機能を導入し、EU AI法の透明性要件をモデルが満たすのに役立つウォーターマークを追加した。
提供状況と今後の展開
Opus 5.5は、AnthropicのAPIを通じて、またAWS、Google Cloud、Microsoft Azureを通じて即座に利用可能である。Anthropicによると、姉妹アップデートであるSonnet 5.5とHaiku 5.5が「今後数週間で」それぞれの価格帯で同様の効率性と性能の向上を伴って続く見込みである。The New Stackの報道はまた、開発者にとっての実務上の問題点を指摘した。つまり、「Opus」モデルファミリーをエイリアスで参照する一部の既存のエージェント統合が、元々指定された正確なモデルバージョンではなく、新しい5.5バージョンに自動的にルーティングされる可能性があり、本番のエージェントパイプラインを運用しているチームは確認する価値がある変更だということである。