# Gemma 4 首周下载量破 200 万，本地跑模型成了新趋势

> 原标题：[AINews] Gemma 4 crosses 2 million downloads

- 来源：Latent Space
- 发布时间：2026-04-07T00:17:23.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/562
- 原文：https://www.latent.space/p/ainews-gemma-4-crosses-2-million

## 摘要

Google 的 Gemma 4 上线第一周就冲到约 200 万次下载。做个对比：Gemma 3 过去一年总共 670 万次，Gemma 2 从 2024 年 6 月到现在 140 万次，而 Qwen 3.5 在大约一个半月里拿了约 2700 万次。这次最值得关注的是本地部署的速度——有人用 iPhone 17 Pro 跑 Gemma 4 E2B，通过...

## 推荐理由

这条消息的看点不是 Google 又发了个模型，而是首周 200 万下载这个数字本身，以及它和 Qwen 3.5 一个半月 2700 万的对比——开源模型的采用速度在明显变快。更实在的是有人已经在 iPhone 上跑出 40 tok/s，这对做端侧部署的人来说是个可参考的实测数据，不是公关稿里的理论值。我会先打个折：下载量不等于日活，正文也没披露留存或实际调用量，所以别直接当成市场份额来看。但生态支持列得挺全，至少说明主流推理框架没掉队，这点对选型有帮助。

## 锐评

Gemma 4 首周约 200 万次下载，这个数字本身不错，但得放在上下文里看：Gemma 3 过去一年总共才 670 万，Gemma 2 从 2024 年 6 月到现在 140 万，而 Qwen 3.5 在大约一个半月里就拿了约 2700 万次。所以 Gemma 4 开局比自家前代强很多，但跟 Qwen 比还差一个数量级，现在说“统治开源”太早了。

真正值得关注的点不是下载量，而是部署方式。有人用 iPhone 17 Pro 跑 Gemma 4 E2B，通过 MLX 跑到每秒约 40 个 token，这个速度在手机上已经能用了。同时 Hugging Face、vLLM、llama.cpp、Ollama、NVIDIA 等一整套工具链在发布当天就同步支持，说明 Google 这次把“开箱即用”的功课补上了。这对那些不想绑在云服务上的开发者是个实打实的信号。

不过正文没披露任何基准测试对比或实际任务表现数据，也没说这 200 万下载里有多少是重复下载或 CI 流水线拉取。光看下载量判断模型质量，我会先打个折。
