OpenAI 将 GPT-5.6 Luna API 成本降低 80%,以吸引高调用量开发者

新闻摘要
OpenAI 于 2026 年 7 月 30 日宣布对其 GPT-5.6 模型系列进行全面降价,将其入门级 Luna 模型的 API 成本最高削减 80%,将其中端 Terra 模型的价格下调 20%,同时保持旗舰模型 Sol 的定价不变。这一举措在太平洋时间上午 9:00 左右的报道中得到证实,距离 GPT-5.6 系列于 2026 年 7 月 9 日首次发布仅过去三周,是 OpenAI 对近期发布的模型系列进行的最大幅度 API 降价之一。
具体变化
根据 OpenAI 更新的定价表,GPT-5.6 Luna 现在每百万输入 token 的价格为 0.20 美元,每百万输出 token 的价格为 1.20 美元,低于其发布时 1.00 美元和 6.00 美元的定价——对于典型工作负载而言,综合降幅约为 80%。GPT-5.6 Terra 是旨在平衡速度与推理深度的中端选项,其费率从每百万输入 token 2.50 美元和每百万输出 token 15.00 美元降至 2.00 美元和 12.00 美元,降幅为 20%。
Sol 是该系列中能力最强的模型,其标准模式的现有费率保持不变,即每百万输入 token 5.00 美元和每百万输出 token 30.00 美元。OpenAI 还推出了新的 Sol 快速模式,面向对延迟敏感的应用,其定价约为标准费率的两倍,以反映为加快响应时间而预留的额外计算资源。
OpenAI 表示能够承担降价的原因
OpenAI 将此次降价主要归因于在 GPT-5.6 本身的开发过程中发现的效率提升。该公司表示,基于该模型系列构建的内部工具(包括自动化代码优化过程)有助于降低处理推理请求的计算成本。OpenAI 特别提到,GPT-5.6 Sol 自主重写了其部分生产服务代码,该公司称这一变化使模型服务成本降低了约 20%。更快的 token 生成速度和改进的批处理效率也被列为促成因素。
竞争与市场背景
此次降价发生在 AI 模型市场竞争日益激烈之际,越来越多的研究实验室和云服务提供商正竞相以更低的单 token 成本提供强大的模型。美国以外实验室开发的开源权重模型取得的快速进展,加上其他主要云服务和 AI 提供商的激进定价举措,对全行业的 API 定价造成了持续的下行压力。运行高调用量工作负载的企业客户(如客户支持自动化、编程助手和大规模文档处理)随着使用规模的扩大,越来越多地要求供应商降低单 token 成本。
行业观察人士指出,这种模式反映了 AI 行业早先的价格周期,即前沿实验室将较低层级的模型作为注重成本的开发者的切入点,同时为用于最苛刻应用的旗舰模型保持溢价。
对开发者的影响
对于基于 OpenAI API 构建的团队而言,这些变化对目前在 Luna 上运行的高调用量、对延迟容忍度高的应用最为重要,其单 token 成本现在已不到发布日价格的四分之一。Terra 的较小降幅仍然显著降低了那些需要比 Luna 更强推理能力但不需要 Sol 全部能力的应用的成本。由于 Sol 的定价未变,工作负载需要最大模型能力的开发者将不会看到直接节省,尽管 Sol 快速模式的增加为他们提供了一个新的选项,可以用成本换取更低的延迟。
关注该公告的分析师表示,降价可能会加速 GPT-5.6 Luna 在依赖频繁、低成本 API 调用的初创企业和教育工具中的普及,而运行大规模批处理任务的企业团队有望获得最大的总体节省。
时间线一览
GPT-5.6 系列于 2026 年 7 月 9 日发布。新定价于 2026 年 7 月 30 日太平洋时间上午约 9:00(美国东部时间中午 12:00)生效,OpenAI 表示更新的费率立即适用于所有 API 客户,无需任何迁移步骤。