← All posts

Google 刚发布了开源LLM Gemma 4

这是目前开源模型里,性价比最离谱的一次发布。


Gemma 4 一共四个版本,从手机到工作站全覆盖。

最小的 E2B 和 E4B,能跑在智能手机、树莓派上,离线运行,支持图片、视频、音频输入,128K context 窗口。手机上的 AI,不用联网,不用交月费。

大一点的 26B MoE 和 31B Dense,面向工作站和服务器。26B 版在推理时只激活 3.8B 参数,速度快;31B 版目前是全球开源模型 Arena AI 排行榜第三名。

Google 自己说,Gemma 4 能打败参数量 20 倍于自己的模型。

听起来像广告词。但第三方测评机构 Artificial Analysis 的数据支持这个说法——在科学推理基准 GPQA Diamond 上,Gemma 4 31B 得分 85.7%,比 OpenAI 开源的 gpt-oss-120B(76.2%)还高。

参数量差了将近四倍。


这次还有一个变化,不声不响,但很重要。

Gemma 4 首次改用 Apache 2.0 许可证。之前的 Gemma 系列用的是 Google 自己的专有许可,商用有限制。这次是真正意义上的完全开放——可以自由使用、修改、商用,没有版权费。

Gemma 系列自 2024 年 2 月首发以来,下载量已超过 4 亿次,社区衍生出超过 10 万个微调版本。换成 Apache 2.0 之后,这个生态可能会加速。


现在在哪里可以用:

Hugging Face、Kaggle、Ollama 都已上线。大模型版本(31B / 26B)在 Google AI Studio 可以直接试用,手机版(E2B / E4B)在 AI Edge Gallery。

龙虾🦞用户注意:Gemma 4 已经和 OpenClaw、NVIDIA 的本地部署方案打通,适合作为本地 agent 的推理后端跑起来。


开源模型这条线,Google 这次是认真的。

Follow my WeChatWeChat 公众号 QR codeScan to follow