# DiffusionGemma：一次生成整段文字，专用 GPU 上快 4 倍

> 原标题：DiffusionGemma：4倍速输出，整块文本同时生成

- 来源：AI HOT 精选
- 发布时间：2026-06-10T16:06:44.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/37362
- 原文：https://x.com/GoogleDeepMind/status/2064741061352636762

## 摘要

Google DeepMind 放出一个实验性开放模型 DiffusionGemma，不走逐词预测的老路，而是同时吐出整块文本。在专用 GPU 上输出速度最高能快 4 倍，模型还能自己纠错、实时渲染复杂 Markdown。正文没披露参数量、训练数据和具体发布时间，这点先别太激动。

## 推荐理由

Google DeepMind 放出一个实验模型，把生成方式从逐词改成整块吐字，速度最高快 4 倍，还能自纠错和实时渲染 Markdown，思路确实新。但正文没给参数量、训练数据和发布时间，离能不能真用还差关键信息，所以先打个折，给 78。

## 锐评

DiffusionGemma 把文本生成从“一个字一个字往外蹦”改成了“整块同时渲染”，思路像图片扩散模型。官方说在专用 GPU 上输出速度最高能快 4 倍，这个数字挺诱人，但没说明跟什么基线比、在什么任务上测的，也没给延迟的绝对值。模型还能自己纠错和实时渲染复杂 Markdown，听起来对代码生成或格式化输出场景有用，但正文没放任何示例或评测结果，说服力打折。

更大的信息缺口是模型本身：参数量、训练数据、许可证、什么时候放出来，全都没提。现在只能把它当一个技术方向信号看——扩散模型做文本生成不是新想法，但做到“开放模型”这一步值得关注。如果后续补上规模和评测，才能判断这 4 倍加速是实打实的省钱，还是特定条件下的实验室数字。
