2026年4月2日,谷歌发布Gemma 4系列开源大模型,这是其Gemma家族迄今规模最大、能力最强的一次升级。此次发布的四款模型覆盖从智能手机到工作站的全部硬件场景,且首次全面采用Apache 2.0商业友好许可证。这一授权转变,被业界视为谷歌在开源AI竞争中战略姿态的根本性转向。

授权壁垒被打破

技术规格之外,Gemma 4最值得关注的变化,是许可证的彻底开放。

此前历代Gemma模型均受谷歌自有专有许可证约束,开发者在商业使用上受到诸多限制。而Gemma 4此次全系采用Apache 2.0许可证发布,开发者对数据、基础设施和模型本身均享有完整控制权。

这一变化的背后,是来自开发者社区的压力长期积累的结果。谷歌表示,自第一代Gemma发布以来,开发者已累计下载超过4亿次,并在此基础上衍生出超过10万个变体,形成了一个庞大的"Gemmaverse"生态。授权的开放,意味着谷歌选择以生态换影响力,而非以授权锁定用户。

四款型号,打穿全部硬件层级

Gemma 4提供四种规格:E2B、E4B、26B A4B(混合专家架构)和31B(稠密架构),可在高端手机、笔记本、个人工作站到服务器等不同环境中部署。

其中小型号的技术路线尤为激进。移动端两款型号E2B与E4B比上代快4倍,电池消耗减少约60%,可在手机、树莓派以及英伟达Jetson Orin Nano上完全离线运行,实现近乎零延迟推理。

大型号则直指旗舰基准。31B稠密模型在Arena AI全球开放模型排行榜中位列第3,26B MoE模型排名第6。谷歌称,Gemma 4的综合表现超过体量达其20倍的竞争模型。

关键基准数据方面,在2026年AIME数学竞赛题集上,31B模型得分89.2%;在竞争性编程基准LiveCodeBench v6上得分80.0%;在科学推理基准GPQA Diamond上得分84.3%。相比之下,上代旗舰Gemma 3 27B在同样三项指标上分别仅为20.8%、29.1%和42.4%,提升幅度显著。

多模态能力全面覆盖,边缘设备率先支持音频

全系四款模型均支持文本和图像输入,其中小型号E2B和E4B额外支持音频输入;所有模型支持视频理解能力,可通过分析帧序列处理视频内容;上下文窗口方面,小型号为128K tokens,大型号扩展至256K tokens。

多语言支持达到140余种语言,原生具备函数调用能力,支持原生系统提示词,为智能体工作流提供结构化工具使用基础。


谷歌Pixel团队首次深度介入,移动端野心浮出水面

值得注意的是,此次Gemma 4是谷歌与其Pixel团队以及高通、联发科等移动芯片巨头联合开发的成果,首批支持设备涵盖最新一代专用AI加速器硬件。

更具战略意味的是,Gemma 4被明确定位为下一代Gemini Nano的基础模型:开发者今天为Gemma 4编写的代码,届时将自动兼容Gemini Nano 4设备,无需重写。这实质上是谷歌以开源模型锁定Android应用生态、提前布局端侧AI场景的战略部署。


产业背景:开源大模型的竞争已经进入参数效率时代

Gemma 4的发布,是近半年来开源AI模型竞赛提速的缩影。此前Meta的Llama系列、阿里的Qwen系列均在积极追赶闭源模型的性能上限。Gemma 4基于谷歌Gemini 3同等底层研究和技术构建,这意味着谷歌在闭源旗舰与开源系列之间的技术代差正在收窄。

谷歌同步在Kaggle上发起"Gemma 4 Good Challenge"公益应用挑战赛,并通过Vertex AI、Cloud Run、GKE等云服务提供生产级部署路径,试图将开源社区热度转化为商业云收入。

Gemma 4模型现已在Hugging Face、Kaggle、Ollama及Google AI Studio上线,开发者可即刻获取模型权重与相关文档。

(本文信息来源:谷歌官方博客、The Decoder、Android Developers Blog)

追加内容

本文作者可以追加内容哦 !