首頁 / 資訊 / Google 跳過旗艦版:三款全新 Gemini Flash 模型主打速度、成本和網路安全
Google

Google 跳過旗艦版:三款全新 Gemini Flash 模型主打速度、成本和網路安全

Jul 22, 20261 分鐘閱讀
Google 跳過旗艦版:三款全新 Gemini Flash 模型主打速度、成本和網路安全

新聞摘要

Google 於 2026 年 7 月 21 日(太平洋時間)推出了 Gemini AI 模型系列的三个新成員,擴充了其產品線,提供了更快且更具成本效益的選項,而非備受期待的 Gemini 3.5 Pro 旗艦模型。此次發布反映了整個行業正朝著為大規模代理工作負載優化 AI 模型轉變,在此類工作負載中,速度、可靠性和每次查詢的成本與原始推理能力同等重要。

發布內容

這三個新模型分別是 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和 Gemini 3.5 Flash Cyber。Google 將此次發布定位於為大規模構建 AI 代理的開發人員帶來效率提升,而非在標竿效能上取得重大突破。此次發布於 2026 年 7 月 21 日(太平洋時間)進行,技術細節隨後發布於 Google 的開發者部落格,並很快分享給新聞媒體。

Gemini 3.6 Flash:新的主力模型

Google 將 Gemini 3.6 Flash 描述為其主力模型,在程式碼輔助、知識型任務以及跨文本、圖像和其他數據類型的多模態理解方面帶來了改進。Google 表示,與其前身 Gemini 3.5 Flash 相比,該模型可將 token 使用量減少高達 17%,這意味著運行高流量應用程式的開發人員的營運成本將降低。

Gemini 3.5 Flash-Lite:專為成本敏感型代理而設計

Gemini 3.5 Flash-Lite 的目標客戶是那些需要以最低成本運行大量輕量級、自主 AI 代理任務的開發人員。Google 為該模型設定的價格為每百萬輸入 token 0.30 美元,每百萬輸出 token 2.50 美元,使其成為目前 Gemini 系列中最經濟實惠的選項。該公司建議此級別非常適合簡單分類、檢索和高頻自動化等任務。

Gemini 3.5 Flash Cyber:專注於安全研究

第三個模型 Gemini 3.5 Flash Cyber 經過專門微調,用於識別和協助修復軟體漏洞。Google 表示,其網路安全分析成本僅為較大型通用模型的一小部分。目前,此模型的存取權限僅限於一項涉及政府機構和選定信任合作夥伴的試點計畫,這反映了安全研究使用案例的敏感性。

為何沒有 Gemini 3.5 Pro

儘管廣泛預期,Google 並未與這三個模型一同發布更新的 Pro 級旗艦模型。相反,該公司證實已開始進行其所謂的「迄今為止最大膽的預訓練運行」,這被廣泛理解為正在為未來的 Gemini 4 模型奠定基礎。行業觀察家認為,這表明 Google 正在優先考慮在其 Flash 級別中進行漸進式效率改進,同時將更長的開發週期投入到下一代前沿模型的開發中。

行業背景

此次發布正值各大 AI 實驗室之間競爭日益激烈之際,它們爭相提供針對實際、注重成本的部署進行調整的模型,而不僅僅是追求頂級的標竿分數。透過強調較低的 token 消費、具競爭力的定價以及像網路安全分析這樣的專業能力,Google 似乎瞄準了那些在生產環境中擴展代理式 AI 系統的企業開發人員。分析師指出,這種方法與其他 AI 公司朝著分級模型系列發展的類似舉措相呼應,這些系列為不同類別的應用程式平衡了功能、延遲和成本。

後續發展

Google 並未提供 Gemini 3.5 Pro 或 Gemini 4 發布的具體時間表,儘管確認正在進行大規模預訓練運行表明對前沿模型開發的持續投資。目前,在 Gemini 平台上進行開發的開發人員將獲得 Google 所稱的三個新選項,這些選項針對大規模運行 AI 代理和安全工具的實際需求進行了優化。

GoogleGemini