OpenAI 推出 GPT-6 Astra,首款網路安全風險評級為「嚴重」的模型

新聞摘要
OpenAI 於 2026 年 9 月 3 日正式推出 GPT-6 Astra,稱其相較前代模型實現了「世代躍進」,也是該公司首次願意將其與通用人工智慧(AGI)的到來聯繫在一起的模型。總裁 Greg Brockman 表示,Astra 在推理、電腦操作與軟體工程能力上帶來了階梯式的提升;同時,OpenAI 也依據其內部的「準備度框架」(Preparedness Framework),將該模型的網路安全風險列為「嚴重」等級——這在 OpenAI 歷次發布中尚屬首次。
推出時程與可用性
Astra 採分階段推出,而非一次性全面開放。首批取得存取權的是 OpenAI Daybreak 計畫的參與者,這是一項需申請的網路安全防禦人員專案,自 2026 年 9 月 3 日星期四(太平洋時間)起生效。該公司表示,ChatGPT Plus、Pro、Business 與 Enterprise 訂閱用戶,以及使用 OpenAI API 的開發者,預計將在「未來數日內」獲得更廣泛的使用權限。此模型也將透過 Amazon Bedrock 提供,API 存取的識別名稱為 gpt-6-astra,並針對用量較高的訂閱方案提供對應的 Astra Pro 層級。
開發者的 API 定價在標準模式下為每百萬輸入 token 10 美元、每百萬輸出 token 50 美元,約為該公司先前旗艦模型 GPT-5.6 Sol 成本的 2.5 倍。另有一種更快的推論模式,號稱在相近任務上延遲可降低約 2.5 倍,其價格則為標準費率的兩倍。
能力與基準測試
OpenAI 將 Astra 定位為在電腦操作、網頁瀏覽、軟體工程、網路安全與科學推理等任務上均達到業界最先進水準的模型。Brockman 特別強調電腦操作是一大亮點功能,指出該模型能「快速處理試算表、填寫表單,並在多個網頁間切換操作」,其速度在他看來已超越人類處理日常辦公事務的能力。
在已公布的基準測試中,Astra 在電腦操作評估項目 OSWorld 2.0 上取得 72.6% 的分數,完成任務所需時間比 GPT-5.6 Sol 減少約 47%。該公司還表示,Astra 在高難度數學基準測試 FrontierMath 的第四級(Tier 4)中達到飽和,得分為 97.6%;而在內部用於評估漏洞發現與利用能力的 ExploitBench 上更取得 100% 的成績,這項結果直接促成了該模型被列為「嚴重」安全等級。
網路安全防護措施與「嚴重」等級
讓 Astra 對防禦者極具價值的相同能力,也在 OpenAI 內部引發警訊。該公司表示,Astra 是首款能在無需人類逐步指導的情況下,自主找出先前未知的安全漏洞,並針對防護嚴密的系統建構有效攻擊程式的模型,因此依據「準備度框架」被列為「嚴重」等級;該框架是 OpenAI 依模型風險程度調整安全防護措施的內部政策。
為管控此風險,OpenAI 表示曾將 Astra 的部分開發工作延後數週,以便在正式推出前新增並測試更多防護機制。該模型最先進的網路安全能力僅限 Daybreak 計畫中少數經審核的測試者使用;且即使在該計畫內,獲准使用者也只能將 Astra 用於常見的網路防禦任務,不得用來開發攻擊程式或策劃主動式網路攻擊。隨著測試持續進行,後續將透過名為 Daybreak Blue 的另一層級,開放更廣泛的防禦用途存取。
業界反應
相關報導指出,Astra 的基準測試成績使其領先其他競爭對手的前沿模型,包括在多份公開排行榜上與 Anthropic 的 Fable 5.1 相比,進一步加劇了各大 AI 實驗室在推理、程式設計與代理式電腦操作任務上的競爭。Brockman 暗示 Astra 可能已符合、或已接近 OpenAI 內部對 AGI 的定義——即在多數具經濟價值的工作中表現優於人類的 AI 系統——此說法引起業界觀察人士的高度關注,不過 OpenAI 尚未正式宣布已跨越該門檻。
後續發展
除了首批 Daybreak 參與者之外,OpenAI 尚未公布一般 ChatGPT 與 API 存取的確切開放日期,僅表示擴展作業將在 2026 年 9 月 3 日公告(太平洋時間)後的數日內進行。該公司表示,將持續依據「準備度框架」監控實際使用情況,並可能在推廣至企業與一般消費者時調整防護措施,尤其是與網路安全相關的功能。