Gemini 3.8 Flash 單次任務成本高出 40%,儘管定價維持不變

新聞摘要
Google 於 2026 年 9 月 2 日推出 Gemini 3.8 Flash,將其定位為迄今最強大的「主力」模型,透過刻意在每次請求中投入更多運算量,來處理軟體工程與多步驟推理任務。同時,Google 也發布了專用版本 Gemini 3.8 Flash Cyber,專為受信任的政府與基礎設施合作夥伴提供自動化漏洞發現與修補功能。這是 Google 約四個月內第四次推出 Flash 級別模型,正值該公司努力向開發者與企業客戶保證,即使競爭對手持續推出具競爭力的系統,其模型發布節奏依然穩定。
「更努力運作」究竟代表什麼
Google 的論述核心在於一項刻意的設計選擇:Gemini 3.8 Flash 並非單純針對速度或最少 token 用量進行最佳化,而是調整為在任務需要時,執行額外的推理步驟並反覆呼叫外部工具。在較高的「運算強度」設定下,模型會消耗更多 token 以追求更完整或更準確的答案;Google 將此權衡描述為提升實際任務完成率,而非僅提高原始基準測試分數。開發者可選擇較低的運算強度等級,以降低對延遲或成本敏感的工作負載之消耗,或繼續使用前一代 Gemini 3.7 Flash 模型——Google 表示該模型仍獲完整支援,適用於效率優先的使用情境。
定價與隱藏的成本增加
從帳面上看,Gemini 3.8 Flash 的初始每 token 價格與前代相同:每百萬輸入 token 0.75 美元、每百萬輸出 token 3.75 美元,此價格適用至美國東部時間 2026 年 12 月 31 日,之後自 2027 年 1 月起,標準價格將分別調漲至 1.50 美元與 7.50 美元。然而,由於該模型傾向產生更多輸出 token,且在作為自主代理運作時會進行更多輪對話,多家測試過該模型的媒體估計,實際任務成本比前一代 Flash 模型高出約 40%,主因是額外推理使每次任務的輸出 token 增加近 30%。換言之,標示價格維持不變,但完成特定工作的總帳單可能上升,因為模型為了達成目標執行了更多工作,也據此收取更多費用。
基準測試表現
Google 表示,Gemini 3.8 Flash 在 DeepSWE v1.1 軟體工程基準測試中的表現優於數款規模更大的前沿模型,且執行成本僅為其零頭;同時在涵蓋 STEM、人文與專業推理任務的 HLE-Verified 基準測試中取得 54.9% 的分數。Artificial Analysis 的獨立評估顯示,該模型在高推理模式下於其智慧指數中獲得 59 分,較前一代 Flash 版本提升 3 分,使其與其他競爭實驗室近期推出的中型前沿模型處於同一級距,但仍落後於該指數中排名頂尖的旗艦模型。在成本效益方面,Artificial Analysis 計算出 Gemini 3.8 Flash 每項智慧指數任務約需 0.58 美元,使其成為該機構追蹤模型中,同效能級距裡最便宜的選項之一。
網路安全版本
Gemini 3.8 Flash Cyber 透過 Google 針對政府與關鍵基礎設施合作夥伴推出的 Fairwind Program 提供給受信任的測試者,專門針對漏洞偵測與自動化修補程式生成進行調校。Google 指出,該模型在用於漏洞發現的 CyberGym 基準測試中超越先前版本,能在約 20 種程式語言中以超過 70% 的成功率找出真實世界漏洞,並在 CWE-Bench 修補程式生成基準測試中達到 47.2% 的通過率,且運作成本明顯低於同級商業工具。Google 也引用自家 Chrome Security 團隊的回饋,該團隊表示 Cyber 模型產生的正確修補程式數量,是其原先使用的領先商業替代方案的 2.6 倍。
可用性與推出進度
Gemini 3.8 Flash 正陸續部署至 Google 的開發者與消費者平台,包括供開發者使用的 Google AI Studio、Android Studio 與 Google Antigravity 程式碼編輯環境,供企業客戶使用的 Gemini Enterprise,以及消費者端的 Gemini 應用程式、Google Search 的 AI Mode,和供 Google AI Pro 與 Ultra 訂閱用戶使用的 Google Sheets 中的 Gemini。Cyber 版本目前仍僅限 Fairwind Program 參與者使用,尚未公布更廣泛開放的時間表。
為何發布節奏如此重要
業界觀察人士指出,這已是 Google 在短短數週內第三次或第四次發布 Flash 級別模型,部分人將此步調解讀為試圖跟上其他主要 AI 實驗室的快速發布節奏,並在近期內部領導層變動後,展現 Google DeepMind 模型路線圖的延續性。該公司先前曾暗示將於今年稍早推出規模更大的 Gemini 3.5 Pro,但至今尚未問世;而這些穩定的小型 Flash 更新,似乎部分意在讓 Gemini 的開發者與企業生態系保持活躍,直到該大型版本正式推出為止。