# Google 发布 Gemma 4 的 QAT 版模型，让手机和笔记本跑起来更省内存

> 原标题：Gemma 4 QAT models: Optimizing compression for mobile and laptop efficiency

- 来源：Hacker News 首页
- 发布时间：2026-06-05T16:18:48.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/34652
- 原文：https://blog.google/innovation-and-ai/technology/developers-tools/quantization-aware-training-gemma-4/

## 摘要

Google 放出了 Gemma 4 的量化感知训练（QAT）检查点。简单说，就是在训练时就考虑压缩，而不是训完再硬压，这样模型在手机、笔记本上跑的时候占内存更小、速度更快。不过这篇公告只给了个标题和链接，正文没披露具体压到几比特、有哪些尺寸、跑分对比和发布时间。我会先打个折，等实际模型放出来再看效果。

## 推荐理由

Google 放出了 Gemma 4 的量化感知训练检查点，目标是在手机和笔记本上跑得更省内存、更快。但公告正文太薄，没给出具体压到几比特、有哪些尺寸、实测提升多少，也没说什么时候能拿到模型。信息缺口明显，只能先给 featured 底分，等实际模型和跑分出来再重新判断。

## 锐评

Google 放出了 Gemma 4 的量化感知训练（QAT）检查点。和训完再硬压不同，QAT 在训练阶段就把低精度计算考虑进去，这样模型在手机、笔记本上跑的时候占内存更小、速度更快。但这条公告只给了标题和链接，正文没披露具体压到几比特、有哪些尺寸、跑分对比和发布时间。信息缺口很大，没法判断实际压缩率和精度损失。我会先打个折，等模型卡和评测放出来再看是不是真省钱。
