Claude Haiku 5.5 降至每百萬 Token 0.10 美元,但超過 10 萬 Token 的提示詞費用高達五倍

新聞摘要
Anthropic 於太平洋時間 2026 年 10 月 7 日上午 11:08 左右發布了 Claude Haiku 5.5,將其定位為 Claude 5.5 系列中最小且最快的模型,並將小型模型 API 存取的入門價格降至每百萬輸入 Token 0.10 美元、每百萬輸出 Token 0.50 美元(適用於長度不超過 10 萬 Token 的提示詞)。這大約比 Claude Haiku 4.5 的 1 美元與 5 美元費率低了 90%。該模型在 Anthropic 自家平台以及 Amazon Web Services、Google Cloud 和 Microsoft Azure 上均可透過識別碼 claude-haiku-5-5 使用。
Anthropic 公布了什麼
Haiku 5.5 的推出距離 Anthropic 於 2026 年 9 月底首次預覽該模型與 Sonnet 5.5 大約過了九天。根據 VentureBeat、MarkTechPost、DataCamp 與 Unite.AI 的報導,此次發布聚焦於三大重點:大幅降低的基礎價格、相較 Haiku 4.5 在實測能力上的顯著躍升,以及一系列面向代理程式的功能,例如可調整的運算強度等級與測試版電腦操作工具。次要報導也提到其上下文視窗最高可達 100 萬 Token、輸出最高可達 12.8 萬 Token,不過 VentureBeat 的文章並未明確指出上下文大小,因此開發者應在 Anthropic 的文件中確認相關限制。
Anthropic 也表示,若將 Token 消耗量與典型請求大小的變化納入考量,實際工作負載的成本應比 Haiku 4.5 低約 75%,這個數字低於標題所稱的 90% 降價幅度。
定價級距說明
Haiku 5.5 採用依提示詞長度區分的兩個價格級距,皆以每百萬 Token 計算:
- 長度不超過 10 萬 Token 的提示詞:輸入 0.10 美元、輸出 0.50 美元、快取讀取 0.01 美元、五分鐘快取寫入 0.125 美元。
- 長度超過 10 萬 Token 的提示詞:輸入 0.50 美元、輸出 2.50 美元、快取讀取 0.05 美元、快取寫入 0.625 美元。
- 作為比較的 Claude Haiku 4.5:輸入 1.00 美元、輸出 5.00 美元、快取讀取 0.10 美元、快取寫入 1.25 美元。
據悉,Batch API 還可再享有 50% 的折扣。多位分析師指出了「10 萬 Token 陷阱」:一旦請求跨越此門檻,便會按較低費率的五倍計費,因此經常傳送長文件或大型程式碼庫的團隊,實際省下的金額可能遠低於標題所暗示的數字。VentureBeat 指出,其文章並未說明剛好 10 萬 Token 的請求如何計費。此外,Anthropic 也將 Sonnet 5.5 的快取讀取價格從每百萬 Token 0.20 美元調降至 0.10 美元。
基準測試結果
以下數據皆由廠商提供,尚未經第三方獨立重現。
- GDPval-AA v2.1(知識工作評估):Haiku 5.5 得分 1,620,Haiku 4.5 為 735,OpenAI 的 GPT-6 Luna 為 1,437,Sonnet 5.5 為 1,840。
- AA-Briefcase v1.1:Haiku 5.5 為 1,578,Haiku 4.5 為 614,GPT-6 Luna 為 1,336,Sonnet 5.5 為 1,824。
- OSWorld 2.1(離線子集,電腦操作測試):Haiku 5.5 為 72.4%,Haiku 4.5 為 15.7%,GPT-6 Luna 為 48.9%,Sonnet 5.5 為 83.9%。
- Terminal-Bench 4.0:在最高運算強度下,Haiku 5.5 為 39.2%,Haiku 4.5 為 0.0%,GPT-6 Luna 為 16.4%,Sonnet 5.5 為 70.6%。在中等運算強度下,Haiku 5.5 約為 20%。
- FrontierCode 1.1:在高運算強度下,Haiku 5.5 為 46.4%,GPT-6 Luna 為 42.4%,Sonnet 5.5 為 52.1%。
獨立評測彙整平台 BenchLM 給予 Haiku 5.5 總分 100 分中的 66.3 分,在其追蹤的 216 個模型中排名第 28。該評分採用不同的方法論,無法直接與 Anthropic 的表格數據相比較。
功能與安全防護
Haiku 5.5 支援可調整的運算強度等級,預設為中等,讓開發者能在速度、成本與推理深度之間取得平衡。Anthropic 稱其為標準速度下最快的模型,但並未公布每秒處理 Token 數的具體數據。測試版的瀏覽器與電腦操作功能可透過 Python 與 TypeScript SDK 使用。
該模型搭載了比 Haiku 4.5 更嚴格的網路安全限制。滲透測試請求會在標準防護機制下遭到阻擋,而通過驗證計畫審查的使用者則可獲得更廣泛的存取權限。Anthropic 也提到隨訂閱方案附贈的每月 API 額度:Max 5x 為 100 美元、Max 20x 為 200 美元,Team 方案則最多可共享 500 美元。
金融科技公司 Rogo 的應用 AI 負責人 Alex Wang 如此描述該模型在企業工作流程中的角色:「它的準確度足以讓我們放心使用,同時又夠快、夠便宜,讓我們能夠大量執行。」
價格比較
VentureBeat 的比較表列出了以下每百萬 Token 的輸入與輸出費率。該表僅比較價格,不涉及能力高低。
- Claude Haiku 5.5:提示詞低於 10 萬 Token 時為 0.10 美元與 0.50 美元。
- GPT-6 Luna:0.10 美元與 0.50 美元,輸入超過 27.2 萬 Token 時需加收費用。
- Gemini 3.5 Flash-Lite:0.30 美元與 2.50 美元。
- Gemini 3.8 Flash:0.75 美元與 3.75 美元,促銷價適用至 2026 年 12 月 31 日。
- Grok 4.3:提示詞低於 20 萬 Token 時為 1.25 美元與 2.50 美元。
- Grok 4.7:提示詞低於 20 萬 Token 時為 2.00 美元與 6.00 美元。
- GPT-6.1 Sol 與 Claude Sonnet 5.5:2.00 美元與 10.00 美元。
對開發者與學習者的意義
小型模型負責處理 AI 應用程式中高流量、重複性的工作:分類客服工單、從文件中擷取欄位、路由請求,以及在大型代理系統內執行子任務。以每百萬輸入 Token 0.10 美元的價格計算,一百萬次各僅數百 Token 的短請求可能只需幾美元,這大幅降低了全球學生、新創公司與研究人員嘗試 AI 的門檻。
這樣的定價結構也帶來了實用的工程啟示。成本不僅取決於每個 Token 的單價,還與提示詞長度、快取及批次處理有關。開發者可以將提示詞控制在 10 萬 Token 門檻以下、以十分之一的輸入價格重複使用已快取的上下文,並針對非緊急任務採用批次處理,以充分發揮新模型的效益。
注意事項
本報導中的多數數據來自 2026 年 10 月 7 日與 8 日發布的新聞報導,而非 Anthropic 的定價頁面,且基準測試數據均由廠商提供。在進行任何預算編列或遷移決策前,應先向 Anthropic 官方文件查證價格、限制與上下文視窗大小。
本文由 AIBARS 編輯部在 AI 輔助下整理。AI 可能出錯,重要資訊請以原始來源為準。發現錯誤?請來信 [email protected]。