# 谷歌发布 Gemma 4，四个尺寸全 Apache 2.0 开源，主打本地跑 agent 和多模态

> 原标题：谷歌昨天发布了 Gemma 4，这次非常牛逼！

- 来源：X · @op7418（歸藏）
- 发布时间：2026-04-03T02:18:10.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/3809
- 原文：https://x.com/op7418/status/2039890169512472793

## 摘要

Gemma 4 一口气发了四个版本：E2B 给手机和 IoT 用，E4B 给移动端和 Jetson/树莓派，26B MoE 每次只激活 3.8B 参数、延迟低吞吐高，31B 全密集版适合桌面或单卡 H100。这次把 agent 工作流当第一优先级，原生支持函数调用、JSON 输出和系统指令，还直接能处理图像、视频和语音转文本，可以做本地语音助手。全部用...

## 推荐理由

谷歌发 Gemma 4 是一次有分量的开源模型更新。HKR 三项都成立：26B MoE 只激活 3.8B 的部署弹性够抓人，四个规格和商用许可给了新事实，成本敏感场景的参考价值也明确。分数定在 81 是因为基准、上下文窗口和测试细节都没披露，我会先打个折，这点先别太激动。

## 锐评

Gemma 4 一口气发了四个版本，从手机到单卡 H100 都能跑，定位很明确：让模型在本地设备上直接干活，而不是只做聊天。26B MoE 版每次只激活 3.8B 参数，理论上延迟低、吞吐高，适合需要快速响应的场景；31B 全密集版则给桌面或单卡工作站用。这次把 agent 工作流当第一优先级，原生支持函数调用、JSON 输出和系统指令，意味着你可以直接把它塞进业务流程里，让它调工具、出结构化结果，不用再外挂一堆中间件。多模态方面，图像、视频、语音转文本都支持，做本地语音助手这条路是通的。Apache 2.0 协议，商用和再分发没额外限制，这点对想内嵌产品的团队比较友好。

但这条消息来自社交媒体帖子，正文没披露任何基准测试分数、上下文窗口大小，也没说实际推理延迟和内存占用。26B MoE 激活 3.8B 听起来省资源，但 MoE 的总参数量大，显存占用不一定低，部署成本还得看实测。另外，agent 和工具调用的稳定性、多模态理解的具体能力边界，这些都没给数据，先别太激动。如果你打算上手试，建议等第三方跑分和实际部署反馈出来再说。
