OpenAI 发布 GPT-6 Astra,首款网络安全风险评级为“严重”的模型

新闻摘要
OpenAI 于 2026 年 9 月 3 日正式发布 GPT-6 Astra,称其相比前代产品实现了“代际飞跃”,也是该公司首款愿意与通用人工智能(AGI)到来相提并论的模型。总裁 Greg Brockman 表示,Astra 在推理、计算机操作和软件工程能力上实现了阶跃式提升;与此同时,OpenAI 依据其内部《准备度框架》将该模型的网络安全风险评定为“严重”——这在 OpenAI 的所有发布产品中尚属首次。
推出计划与可用范围
Astra 将分阶段推出,而非一次性全面开放。首批获得访问权限的是 OpenAI Daybreak 计划的参与者,这是一项面向网络安全防御者的申请制项目,自 2026 年 9 月 3 日星期四(太平洋时间)起生效。据该公司介绍,ChatGPT Plus、Pro、Business 和 Enterprise 订阅用户,以及使用 OpenAI API 的开发者,预计将在“未来几天内”获得更广泛的使用权限。该模型也将通过 Amazon Bedrock 提供,API 访问标识符为 gpt-6-astra,并为高用量订阅方案提供相应的 Astra Pro 层级。
面向开发者的 API 定价为标准模式下每百万输入 token 10 美元、每百万输出 token 50 美元,约为该公司上一代旗舰模型 GPT-5.6 Sol 成本的 2.5 倍。此外还提供一种更快的推理模式,承诺在同类任务上延迟降低约 2.5 倍,其价格为标准费率的两倍。
能力与基准测试
OpenAI 将 Astra 定位为在计算机操作、网页浏览、软件工程、网络安全和科学推理任务上均达到业界最先进水平的模型。Brockman 重点强调了计算机操作这一主打功能,称该模型能够“快速处理电子表格、填写表单并在网页间自如导航”,其速度在处理日常办公任务时堪称超越人类。
在已公布的基准测试中,Astra 在计算机操作评测 OSWorld 2.0 上得分 72.6%,完成任务所需时间比 GPT-5.6 Sol 缩短约 47%。该公司还报告称,Astra 在高难度数学基准 FrontierMath 的第 4 层级上达到饱和,得分为 97.6%;在 ExploitBench 上达到 100%,这是一项针对漏洞发现与利用能力的内部评测,直接促成了该模型获得“严重”安全分类。
网络安全防护与“严重”评级
让 Astra 对防御者极具价值的这些能力,同样在 OpenAI 内部敲响了警钟。该公司表示,Astra 是首个能够在无需人类逐步指导的情况下,自主发现此前未知的安全漏洞,并针对防护严密的系统构建有效攻击利用程序的模型。这促使它依据《准备度框架》被评定为“严重”级别,该框架是 OpenAI 根据模型风险等级相应提升安全防护措施的内部政策。
为管控这一风险,OpenAI 表示已将 Astra 的部分开发工作推迟了数周,以便在正式发布前增加并测试额外的防护措施。该模型最先进的网络安全能力仅限 Daybreak 计划中少量经过审核的测试人员使用;即便在该计划内,获批用户也只能将 Astra 用于常规网络防御任务,而被禁止用它开发攻击利用程序或策划进攻性网络攻击。随着测试继续推进,公司计划通过名为 Daybreak Blue 的更高层级提供更广泛的防御性访问权限。
行业反响
相关报道指出,Astra 的基准测试结果使其领先于竞争对手的前沿模型,包括在多个已公布的排行榜上与 Anthropic 的 Fable 5.1 的对比,这进一步加剧了头部 AI 实验室在推理、编程和智能体计算机操作任务上的竞争。Brockman 暗示 Astra 可能已经达到或接近 OpenAI 内部对 AGI 的定义——即在大多数具有经济价值的工作中表现优于人类的 AI 系统——这一说法引起了行业观察人士的广泛关注,不过 OpenAI 并未正式宣布已达到该门槛。
后续进展
OpenAI 尚未公布在首批 Daybreak 参与者之外全面开放 ChatGPT 和 API 访问的具体日期,仅表示扩展将在 2026 年 9 月 3 日(太平洋时间)发布公告后的数天内完成。该公司表示,将继续依据《准备度框架》监控实际使用情况,并可能随着推广范围扩大到企业和消费者群体而调整防护措施,尤其是涉及网络安全相关功能的部分。