Google Gemma 4 登場,附帶 Apache 2.0 授權並榮獲開源模型前三名

新聞摘要
2026 年 4 月 2 日 (ET) — Google 正式發布了其迄今為止最強大的開放模型系列 Gemma 4。Gemma 4 基於與 Google 專有 Gemini 3 相同的基礎研究和技術構建,標誌著開放式 AI 生態系統的一個重要里程碑——為從智慧型手機到高性能工作站的各種設備帶來企業級智慧。
四種模型尺寸,滿足各種使用場景
Gemma 4 提供四種不同的配置,每種配置都針對不同的硬體功能和效能需求進行了客製化:
E2B (有效 20 億參數) 是最緊湊的版本,專為邊緣硬體上的最大速度和超低延遲而設計。它支援 128K 個 token 的上下文窗口,可在 Android 手機、Raspberry Pi 和 NVIDIA Jetson Orin Nano 上運行,並且獨特地支援音訊輸入以及文字和圖像處理。
E4B (有效 40 億參數) 在保持針對行動和嵌入式設備進行優化的同時,提供了更強的推理能力。與 E2B 一樣,它具有 128K 的上下文窗口和包括音訊在內的多模態支援。Google 報告稱,E4B 的速度比上一代模型快 4 倍,電池消耗量減少高達 60%——這對於設備端 AI 應用來說是一項顯著成就。
26B MoE (混合專家模型) 是一個 260 億參數的模型,在推理時僅激活 38 億參數,從而在消費級 GPU 和工作站上實現快速的 token 生成。它支援 256K 的上下文窗口,目前在 Arena AI 文字排行榜上所有開放模型中排名第六。
31B Dense 是 Gemma 4 的旗艦模型,專為最大化輸出品質而設計。憑藉 256K 個 token 的上下文窗口,它以其原生的 bfloat16 格式可以容納在單個 80 GB NVIDIA H100 GPU 中。量化版本也可以在消費級顯示卡上運行。它目前在 Arena AI 排行榜上所有開放模型中全球排名第三——對於如此規模的開放權重模型來說,這是一項重大成就。
首次:用於商業用途的 Apache 2.0 授權
Gemma 4 發布中最具影響力的公告之一是採用了 Apache 2.0 授權——這是 Gemma 模型系列的首次。先前的 Gemma 版本是在更具限制性的 Google 專有授權下發布的。
Apache 2.0 授權賦予開發者完全的自由,可以在商業應用中使用、修改和部署模型,而無需支付版稅。這一轉變使 Gemma 4 成為企業開源 AI 領域的有力競爭者,為開發者提供了對其數據、基礎設施和部署環境(無論是本地部署還是雲端部署)的完全控制。
效能超越其規模
Google聲稱 Gemma 4 模型在效能上持續超越參數量高達其 20 倍的競爭對手。與發布同時發布的基準測試數據支持了這一說法,涵蓋了多項標準評估:
在 AIME 2026(高級數學)測試中,Gemma 4 31B 模型取得了令人印象深刻的 89.2% 的分數,而 Gemma 3 27B 的分數僅為 20.8%。在 LiveCodeBench v6(競爭性程式設計)測試中,31B 模型得分為 80.0%,而較小的 E4B 和 E2B 版本分別得分為 52.0% 和 44.0%——對於旨在運行在消費級硬體上的模型來說,這是強勁的結果。在 GPQA Diamond(科學推理)測試中,31B 模型取得了 84.3% 的分數,再次大幅超越其前代產品。
為代理式 AI 工作流程而建
除了原始基準測試效能外,Gemma 4 的設計還考慮了代理式應用。所有模型尺寸都原生支援函數調用、結構化 JSON 輸出和系統指令——這些功能使 AI 代理能夠在沒有手動協調的情況下跨多個工具和 API 進行協調。
Google 將 Gemma 4 的應用範圍描述為涵蓋「從簡單的聊天到複雜的邏輯和代理式工作流程」,這使得該模型系列適用於從個人助理應用到自動化軟體管道的各種用途。
預設支援多語言和多模態
Gemma 4 原生支援超過 140 種語言,Google 表示這能夠為全球受眾提供「改進的本地化、多語言體驗」。在多模態方面,所有四種模型變體都支援視覺輸入(圖像和影片),而 E2B 和 E4B 邊緣模型還額外支援音訊輸入——這使其成為可用於真實世界多模態任務的最強大小型模型之一。
Android 整合和開發者存取
Google 的 Android 開發者部落格於 2026 年 4 月 2 日 (ET) 確認,Gemma 4 將作為下一代 Gemini Nano 的基礎,Gemini Nano 是為 Android 智慧型手機提供動力的設備端 AI。今天為 Gemma 4 編寫的程式碼將與未來的 Gemini Nano 4 設備相容,從而簡化從開發到生產的路徑。
開發者可以透過多種管道存取 Gemma 4。31B 和 26B MoE 模型可在 Google AI Studio 中取得。邊緣 E4B 和 E2B 模型可透過 AI Edge Gallery 應用程式進行測試。模型權重可從 Hugging Face、Kaggle 和 Ollama 免費下載。Android 開發者還可以選擇加入 AICore 開發者預覽版,以便在支援的設備上直接運行模型,利用來自 Google、聯發科和高通技術的專用 AI 加速器。
行業生態系統支援
此次發布已獲得主要行業合作夥伴的支持。NVIDIA 宣布針對其 RTX PC 系列和 DGX Spark 硬體對 Gemma 4 進行優化,重點關注本地代理式 AI 用例。高通和聯發科與 Google 合作開發了邊緣模型變體,以確保在行動 SoC 上進行高效推理。
在哪裡取得 Gemma 4
Gemma 4 模型權重現已透過以下平台提供:
Hugging Face、Kaggle 和 Ollama 都託管可下載的模型權重。Google AI Studio 提供對 26B MoE 和 31B Dense 模型的託管存取。AI Edge Gallery 應用程式提供對 E2B 和 E4B 變體的行動優化存取。Android 開發者可以註冊 AICore 開發者預覽版進行設備端測試。
結語
Gemma 4 的發布突顯了 AI 行業的一個更廣泛趨勢:功能強大、可投入生產的 AI 模型越來越容易在專有雲服務之外取得。憑藉 Apache 2.0 授權、廣泛的硬體相容性、強勁的基準測試效能以及內建的多模態功能,Gemma 4 為尋求強大 AI 工具的開發者、研究人員和組織邁出了有意義的一步,這些工具可以由他們自己部署和客製化。