首页 / 资讯 / Claude Haiku 5.5 降至每百万 Token 0.10 美元,但超过 10 万 Token 的提示词费用翻五倍
Anthropic

Claude Haiku 5.5 降至每百万 Token 0.10 美元,但超过 10 万 Token 的提示词费用翻五倍

2026年10月8日5 分钟阅读
Claude Haiku 5.5 降至每百万 Token 0.10 美元,但超过 10 万 Token 的提示词费用翻五倍

新闻摘要

Anthropic 于太平洋时间 2026 年 10 月 7 日上午 11:08 左右发布了 Claude Haiku 5.5,将其定位为 Claude 5.5 系列中体积最小、速度最快的模型,并将小模型 API 调用的入门价格降至每百万输入 Token 0.10 美元、每百万输出 Token 0.50 美元(适用于不超过 10 万 Token 的提示词)。这大约比 Claude Haiku 4.5 的 1 美元和 5 美元费率低 90%。该模型在 Anthropic 自有平台以及 Amazon Web Services、Google Cloud 和 Microsoft Azure 上均可通过标识符 claude-haiku-5-5 使用。

Anthropic 公布了哪些内容

Haiku 5.5 的发布距离 Anthropic 在 2026 年 9 月底首次与 Sonnet 5.5 一同预览该模型大约九天。根据 VentureBeat、MarkTechPost、DataCamp 和 Unite.AI 的报道,此次发布围绕三大核心:更低的基础价格、相比 Haiku 4.5 在实测能力上的大幅跃升,以及一系列面向智能体的功能(如可调节的努力级别和测试版计算机操作工具)。次要报道还提到其上下文窗口最高可达 100 万 Token,输出最高可达 12.8 万 Token,不过 VentureBeat 的文章并未说明上下文大小,因此开发者应在 Anthropic 的文档中确认具体限制。

Anthropic 还表示,如果将 Token 消耗量和典型请求规模的变化考虑在内,实际工作负载的成本应比使用 Haiku 4.5 时低约 75%,这一数字小于标题中所称的 90% 降价幅度。

价格分级详解

Haiku 5.5 采用两个与提示词长度挂钩的价格层级,均以每百万 Token 计价:

  • 不超过 10 万 Token 的提示词:输入 0.10 美元,输出 0.50 美元,缓存读取 0.01 美元,五分钟缓存写入 0.125 美元。
  • 超过 10 万 Token 的提示词:输入 0.50 美元,输出 2.50 美元,缓存读取 0.05 美元,缓存写入 0.625 美元。
  • 作为对比的 Claude Haiku 4.5:输入 1.00 美元,输出 5.00 美元,缓存读取 0.10 美元,缓存写入 1.25 美元。

据报道,Batch API 还可再享受 50% 的折扣。多位分析师指出了“10 万 Token 陷阱”:一旦请求越过该阈值,就会按低价的五倍计费,因此经常发送长文档或大型代码库的团队所获得的节省可能远低于宣传数字。VentureBeat 指出,其文章并未说明恰好为 10 万 Token 的请求如何计费。Anthropic 还将 Sonnet 5.5 的缓存读取价格从每百万 Token 0.20 美元下调至 0.10 美元。

基准测试结果

以下数据由厂商提供,尚未经过独立复现。

  • GDPval-AA v2.1(一项知识工作评估):Haiku 5.5 得分为 1,620,Haiku 4.5 为 735,OpenAI 的 GPT-6 Luna 为 1,437,Sonnet 5.5 为 1,840。
  • AA-Briefcase v1.1:Haiku 5.5 为 1,578,Haiku 4.5 为 614,GPT-6 Luna 为 1,336,Sonnet 5.5 为 1,824。
  • OSWorld 2.1(离线子集,一项计算机操作测试):Haiku 5.5 为 72.4%,Haiku 4.5 为 15.7%,GPT-6 Luna 为 48.9%,Sonnet 5.5 为 83.9%。
  • Terminal-Bench 4.0:在最高努力级别下,Haiku 5.5 为 39.2%,Haiku 4.5 为 0.0%,GPT-6 Luna 为 16.4%,Sonnet 5.5 为 70.6%。在中等努力级别下,Haiku 5.5 得分约为 20%。
  • FrontierCode 1.1:在高努力级别下,Haiku 5.5 为 46.4%,GPT-6 Luna 为 42.4%,Sonnet 5.5 为 52.1%。

独立聚合平台 BenchLM 给 Haiku 5.5 打出了总分 66.3 分(满分 100 分),在其追踪的 216 个模型中排名第 28 位。该分数采用了不同的评估方法,无法与 Anthropic 的表格直接比较。

功能与安全措施

Haiku 5.5 支持可调节的努力级别,默认值为中等,开发者可在速度、成本与推理深度之间进行权衡。Anthropic 称其为标准速度下最快的模型,但未公布每秒处理 Token 数的具体数据。测试版的浏览器和计算机操作功能可通过 Python 和 TypeScript SDK 使用。

该模型的安全限制比 Haiku 4.5 更为严格。在标准安全措施下,渗透测试请求会被拦截,而通过验证计划审核的用户可获得更广泛的访问权限。Anthropic 还提到了随订阅附带的每月 API 额度:Max 5x 为 100 美元,Max 20x 为 200 美元,Team 计划最多可共享 500 美元。

金融科技公司 Rogo 的应用 AI 负责人 Alex Wang 这样描述该模型在企业工作流中的作用:“它足够准确,让我们敢于信赖;同时又足够快、足够便宜,可以大量运行。”

价格对比情况

VentureBeat 的对比表列出了以下每百万 Token 的输入和输出费率。该表仅比较价格,不涉及能力对比。

  • Claude Haiku 5.5:提示词低于 10 万 Token 时为 0.10 美元和 0.50 美元。
  • GPT-6 Luna:0.10 美元和 0.50 美元,输入超过 27.2 万 Token 时需加收费用。
  • Gemini 3.5 Flash-Lite:0.30 美元和 2.50 美元。
  • Gemini 3.8 Flash:0.75 美元和 3.75 美元,促销价持续至 2026 年 12 月 31 日。
  • Grok 4.3:提示词低于 20 万 Token 时为 1.25 美元和 2.50 美元。
  • Grok 4.7:提示词低于 20 万 Token 时为 2.00 美元和 6.00 美元。
  • GPT-6.1 Sol 和 Claude Sonnet 5.5:2.00 美元和 10.00 美元。

对开发者和学习者的意义

小模型负责处理 AI 应用中高并发、重复性的部分:分类工单、从文档中提取字段、路由请求,以及在更大的智能体系统中运行子任务。在每百万输入 Token 0.10 美元的价格下,一百万个各含数百 Token 的短请求只需几美元,这为全球尝试 AI 的学生、初创公司和研究人员降低了门槛。

这种定价结构也提供了一个实用的工程经验:成本不仅取决于单个 Token 的单价,还与提示词长度、缓存和批处理有关。开发者可以将提示词控制在 10 万 Token 阈值以内,以输入价格的十分之一复用缓存上下文,并对非紧急任务使用批处理,从而最大限度地发挥新模型的价值。

注意事项

本报告中的大多数数据来自 2026 年 10 月 7 日和 8 日发布的报道,而非 Anthropic 的定价页面,且基准测试数据由厂商提供。在做出任何预算或迁移决策之前,应根据 Anthropic 的官方文档核实价格、限制和上下文窗口信息。

本文由 AIBARS 编辑部在 AI 辅助下整理。AI 可能出错,重要信息请以原始来源为准。发现错误?请发邮件至 [email protected]。

AnthropicClaude