DiffusionGemma:一次生成整段文字,专用 GPU 上快 4 倍
DiffusionGemma:4倍速输出,整块文本同时生成
Google DeepMind 放出一个实验性开放模型 DiffusionGemma,不走逐词预测的老路,而是同时吐出整块文本。在专用 GPU 上输出速度最高能快 4 倍,模型还能自己纠错、实时渲染复杂 Markdown。正文没披露参数量、训练数据和具体发布时间,这点先别太激动。
推荐理由:Google DeepMind 放出一个实验模型,把生成方式从逐词改成整块吐字,速度最高快 4 倍,还能自纠错和实时渲染 Markdown,思路确实新。但正文没给参数量、训练数据和发布时间,离能不能真用还差关键信息,所以先打个折,给 78。