OpenAI 將 GPT-5.6 Luna API 成本降低 80%,以吸引高用量開發者

新聞摘要
OpenAI 於 2026 年 7 月 30 日宣布全面調降其 GPT-5.6 模型系列的價格,將入門級 Luna 模型的 API 成本最高調降 80%,並將中階 Terra 模型調降 20%,同時維持旗艦模型 Sol 的定價不變。這項於太平洋時間上午 9:00 左右的報導中獲得證實的舉措,距離 GPT-5.6 系列於 2026 年 7 月 9 日首次發布僅三週,這也是 OpenAI 針對近期發布的模型系列所實施的最重大 API 降價之一。
具體變更
根據 OpenAI 更新後的定價表,GPT-5.6 Luna 現在每百萬輸入 token 的成本為 0.20 美元,每百萬輸出 token 為 1.20 美元,低於其發布時的 1.00 美元和 6.00 美元定價——對於典型的工作負載而言,降幅約為 80%。GPT-5.6 Terra 是為兼顧速度與推理深度而打造的中階選項,其費率從每百萬輸入 token 2.50 美元和每百萬輸出 token 15.00 美元降至 2.00 美元和 12.00 美元,降幅為 20%。
Sol 是該系列中功能最強大的模型,其 Standard 模式維持現有的每百萬輸入 token 5.00 美元和每百萬輸出 token 30.00 美元的費率。OpenAI 還推出了新的 Sol Fast 模式,專為對延遲敏感的應用程式而設計,其定價約為 Standard 費率的兩倍,以反映為加快回應時間而保留的額外運算資源。
OpenAI 表示能夠降價的原因
OpenAI 將此次降價主要歸功於在 GPT-5.6 開發過程中發現的效率提升。該公司表示,基於該模型系列構建的內部工具——包括自動化的程式碼最佳化過程——有助於降低提供推理請求服務的運算成本。OpenAI 特別提到 GPT-5.6 Sol 自主重寫了其部分生產服務程式碼,該公司表示這一改變使模型服務成本降低了約 20%。更快的 token 生成速度和提升的批次處理效率也被列為促成因素。
競爭與市場背景
此次降價發生於 AI 模型市場競爭日益加劇之際,越來越多的研究實驗室和雲端服務供應商正競相以更低的單一 token 成本提供功能強大的模型。美國境外實驗室開發的開放權重模型快速發展,加上其他主要雲端和 AI 供應商積極的定價策略,對整個產業的 API 定價造成了持續的下行壓力。運行高用量工作負載的企業客戶——例如客戶支援自動化、程式碼編寫助手和大規模文件處理——隨著使用規模擴大,越來越傾向於要求供應商降低單一 token 成本。
業界觀察家指出,這種模式反映了先前在整個 AI 產業中看到的價格循環,在這些循環中,前沿實驗室將較低階的模型作為吸引注重成本的開發者的切入點,同時為用於最高要求應用程式的旗艦模型保留溢價。
對開發者的意義
對於基於 OpenAI API 構建應用程式的團隊來說,這些變更對目前運行於 Luna 上的高用量、可容忍延遲的應用程式影響最為顯著,其單一 token 成本現已不到發布時價格的四分之一。Terra 較小的降幅仍然實質降低了需要比 Luna 更強推理能力、但不需要 Sol 完整功能的應用程式成本。由於 Sol 的定價不變,工作負載需要最大模型能力的開發者將無法直接節省成本,儘管 Sol Fast 模式的加入為他們提供了一個用成本換取更低延遲的新選項。
關注此公告的分析師表示,這些降價可能會加速 GPT-5.6 Luna 在依賴頻繁、低成本 API 呼叫的新創公司和教育工具中的普及,而運行大規模批次任務的企業團隊則可望獲得最大的總體節省。
時間軸一覽
GPT-5.6 系列於 2026 年 7 月 9 日發布。新定價於 2026 年 7 月 30 日太平洋時間上午 9:00(美國東部時間中午 12:00)生效,OpenAI 表示更新的費率立即適用於所有 API 客戶,無需任何遷移步驟。