首页 / 资讯 / 谷歌Gemma 4问世,附带Apache 2.0许可证并位列开放模型排行榜前三
谷歌AI

谷歌Gemma 4问世,附带Apache 2.0许可证并位列开放模型排行榜前三

2026年4月3日1 分钟阅读
谷歌Gemma 4问世,附带Apache 2.0许可证并位列开放模型排行榜前三

新闻摘要

2026年4月2日(美国东部时间) — 谷歌正式发布了其迄今为止最强大的开放模型系列 Gemma 4。Gemma 4 基于谷歌专有 Gemini 3 的相同基础研究和技术构建,标志着开放式人工智能生态系统的一个重要里程碑——将企业级智能带入从智能手机到高性能工作站的各种设备。

四种模型尺寸,满足各种用例

Gemma 4 提供四种不同的配置,每种配置都针对不同的硬件能力和性能需求进行了定制:

E2B(有效20亿参数) 是最紧凑的版本,专为边缘硬件上的最大速度和超低延迟而设计。它支持128K个token的上下文窗口,可在Android手机、Raspberry Pi和NVIDIA Jetson Orin Nano上运行,并独家支持音频输入以及文本和图像处理。

E4B(有效40亿参数) 在保持对移动和嵌入式设备的优化同时,提供了更强的推理能力。与E2B一样,它具有128K的上下文窗口和包括音频在内的多模态支持。谷歌报告称,E4B比上一代模型快4倍,电池消耗少60%——这对于设备上的人工智能应用来说是一项显著成就。

26B MoE(混合专家模型) 是一个260亿参数的模型,在推理时仅激活38亿参数,从而能够在消费级GPU和工作站上实现快速的token生成。它支持256K的上下文窗口,目前在Arena AI文本排行榜上所有开放模型中排名第六。

31B Dense 是Gemma 4的旗舰模型,专为最大化输出质量而设计。它拥有256K个token的上下文窗口,以其原生的bfloat16格式可以装入单个80GB的NVIDIA H100 GPU。量化版本也可以在消费级显卡上运行。它目前在Arena AI排行榜上所有开放模型中全球排名第三——对于如此规模的开放权重模型来说,这是一项重大成就。

首次采用:用于商业用途的Apache 2.0许可证

Gemma 4发布中最具影响力的公告之一是采用了Apache 2.0许可证——这是Gemma模型系列首次采用该许可证。之前的Gemma版本是在更具限制性的谷歌专有许可证下发布的。

Apache 2.0许可证赋予开发人员完全的自由,可以在商业应用中使用、修改和部署模型,而无需支付版税。这一转变使Gemma 4成为企业开源AI领域的重要竞争者,为开发人员提供了对其数据、基础设施和部署环境(无论是本地部署还是云部署)的完全控制权。

性能超越其参数规模

谷歌声称,Gemma 4模型在性能上持续超越其参数规模20倍的竞争对手。与公告一同发布的基准测试数据显示,在几项标准评估中支持了这一说法:

在AIME 2026(高级数学)测试中,Gemma 4 31B模型取得了令人印象深刻的89.2%的分数,而Gemma 3 27B仅为20.8%。在LiveCodeBench v6(竞赛编程)测试中,31B模型得分为80.0%,而较小的E4B和E2B版本分别得分为52.0%和44.0%——对于设计用于在消费级硬件上运行的模型来说,这是强劲的结果。在GPQA Diamond(科学推理)测试中,31B模型取得了84.3%的成绩,再次大幅超越了其前代产品。

为智能体AI工作流而构建

除了原始基准性能外,Gemma 4的设计还考虑了智能体应用。所有模型尺寸都原生支持函数调用、结构化JSON输出和系统指令——这些功能使AI智能体能够在无需手动协调的情况下,跨多个工具和API进行协调。

谷歌将Gemma 4的全部应用范围描述为涵盖“从简单的聊天到复杂的逻辑和智能体工作流”,使其模型系列适用于从个人助理应用程序到自动化软件管道的各种场景。

默认支持多语言和多模态

Gemma 4 原生支持超过140种语言,谷歌表示这使得“为全球受众提供改进的本地化、多语言体验”。在多模态方面,所有四种模型变体都支持视觉输入(图像和视频),而E2B和E4B边缘模型还支持音频输入——这使其成为可用于现实世界多模态任务的最强大的小型模型之一。

Android集成和开发者访问

谷歌的Android开发者博客于2026年4月2日(美国东部时间)确认,Gemma 4将作为下一代Gemini Nano的基础,Gemini Nano是为Android智能手机提供动力的设备上AI。今天为Gemma 4编写的代码将与未来支持Gemini Nano 4的设备兼容,从而简化从开发到生产的流程。

开发人员可以通过多种渠道访问Gemma 4。31B和26B MoE模型可在Google AI Studio中使用。边缘E4B和E2B模型可通过AI Edge Gallery应用程序进行测试。模型权重可从Hugging Face、Kaggle和Ollama免费下载。Android开发者还可以选择加入AICore开发者预览版,直接在支持的设备上运行模型,利用来自谷歌、联发科和高通技术的专用AI加速器。

行业生态系统支持

此次发布已吸引了主要行业合作伙伴的支持。NVIDIA宣布了其RTX PC系列和DGX Spark硬件对Gemma 4的优化,重点关注本地智能体AI用例。高通和联发科与谷歌合作开发了边缘模型变体,以确保在移动SoC上实现高效推理。

在哪里获取Gemma 4

Gemma 4模型权重现已通过以下平台提供:

Hugging Face、Kaggle和Ollama都托管可下载的模型权重。Google AI Studio提供对26B MoE和31B Dense模型的托管访问。AI Edge Gallery应用程序提供对E2B和E4B变体的移动优化访问。Android开发者可以注册AICore开发者预览版进行设备上测试。

结束语

Gemma 4的发布凸显了人工智能行业的一个更广泛趋势:功能强大、可投入生产的人工智能模型越来越容易在专有云服务之外获得。凭借Apache 2.0许可、广泛的硬件兼容性、强大的基准性能以及内置的多模态能力,Gemma 4代表着一个有意义的进步,为寻求强大AI工具并希望按照自己的方式进行部署和定制的开发人员、研究人员和组织带来了福音。

谷歌AI