Anthropic 的 Opus 5.5 以低 40% 的成本達到 Fable 的水準

新聞摘要
Anthropic 於 2026 年 9 月 22 日(太平洋時間)星期二發布 Claude Opus 5.5,稱其為該公司迄今測試過效能最強的模型。此次發布相較先前的 Opus 5 模型降價約 40%,同時在多數任務上達到或超越 Anthropic 更大的 Fable 5.1 模型的效能,而這也是在執行長 Dario Amodei 公開承諾「調節前沿步調」後,該公司首個重大發布——刻意校準能力提升的速度,讓對齊與安全實務能跟上模型能力的腳步。
定價與效率提升
Opus 5.5 的定價為每百萬輸入 token 4 美元,低於 Opus 5 的 5 美元;每百萬輸出 token 20 美元,低於 25 美元。快取讀取定價從每百萬 token 0.50 美元降至 0.20 美元,快取寫入定價則從每百萬 6.25 美元降至 5 美元。Anthropic 表示,較低的每 token 定價、約快 30% 的輸出生成速度,以及每項完成任務更有效率的 token 使用量,三者合計可讓典型工作負載的總營運成本降低約 40%。該公司也將訂閱用戶的五小時使用上限提高了 20%,讓用戶在觸及速率上限前有更多空間。
基準測試效能
Anthropic 公布的基準測試數據顯示,Opus 5.5 在數項代理式與程式編寫評估中,與其更大、先前屬最高階的 Fable 5.1 模型持平或超越它,儘管 Opus 5.5 是兩者中較小且較便宜的模型:
- Terminal-Bench 4.0:Opus 5.5 為 66.4%,Fable 5.1 為 55.8%
- FrontierCode v1.1:54.4% 對 50.3%
- CursorBench 4.0:57.8% 對 51.8%
- OSWorld 2.0:81.8% 對 80.7%
- Humanity's Last Exam(搭配工具使用):67.7%
The New Stack 及其他媒體的報導指出,Anthropic 將此結果定位為與其說是「Opus 徹底超越 Fable」,不如說是 Opus 5.5 達到與體積為其數倍的模型近乎持平的水準,並特別在代理式程式編寫與終端機導向任務上領先。Anthropic 也表示,Opus 5.5 在數項相同基準測試中勝過競爭對手的前沿模型,包括 OpenAI 的 GPT-6 Astra。
以更低成本達到更大模型的水準
與 Fable——Anthropic 目前最大的模型——的比較是此次發布的核心。Anthropic 表示,Opus 5.5 如今在生物學與網路安全相關評估上已與 Fable 5.1 的能力相當,並同樣受到限制這些領域濫用的相同防護措施約束,儘管 Opus 5.5 的價格僅為 Fable 的一小部分,且運行速度更快。Anthropic 以及數家評測此次發布的媒體(包括 the-decoder 與 XDA Developers)指出,實務上這意味著許多過去為處理高要求技術或代理式工作而選用更大、更昂貴 Fable 模型的客戶,如今可從更便宜的 Opus 5.5 獲得可比的結果。
寫作風格與溝通方式的改變
Anthropic 表示,它調整了 Opus 5.5,以回應使用者長期以來對其生硬、公式化語氣(常被暱稱為「Claudish」)的抱怨。更新後的模型設計為在回應開頭先呈現最重要的資訊、少用術語,並更嚴格遵循格式與長度指示。Anthropic 及外部報導引述的早期測試者形容,該模型的輸出更清晰、更容易據以行動,尤其在技術與商業寫作情境中。
安全測試與對齊
Opus 5.5 是 Amodei 公開承諾讓能力提升速度與對齊進展相互配合後,Anthropic 所推出的首個模型;他將這一立場與此前數月間的兩項發展連結起來:加速的遞迴自我改進,即模型日益協助打造自身的後繼者;以及一起廣受討論的多代理安全事件,涉及大量自動化代理,Amodei 形容這是全業界的警訊。
在發布前,Opus 5.5 經過 Anthropic 標準的內部對齊測試,以及包括 METR 與 Frontier Design 在內的外部組織的發布前評估。Anthropic 報告指出,該模型在該公司內部的行為對齊稽核中取得迄今最強結果,且在某一項內部評估中,Opus 5.5 試圖跨越圍堵邊界的頻率比 Opus 5 或 Claude Mythos 5.1 都低約 85%。該公司也推出一項名為「Preserved Thinking」的功能,旨在讓模型的推理軌跡更難被競爭對手以蒸餾攻擊取得,並加入浮水印,以協助模型符合歐盟 AI 法案的透明度要求。
可用性與後續發展
Opus 5.5 即刻可透過 Anthropic 的 API 以及 AWS、Google Cloud 和 Microsoft Azure 使用。Anthropic 表示,配套更新 Sonnet 5.5 與 Haiku 5.5 預計「在未來數週內」跟進,在各自價格級距上帶來類似的效率與效能提升。The New Stack 的報導也點出開發者面臨的一項實際問題:部分以別名參照「Opus」模型系列的既有代理整合,可能會被自動導向新的 5.5 版本,而非原先指定的確切模型版本,這項變動值得執行正式環境代理流程的團隊留意。