# 商汤 SenseNova-U1 开源 8 步蒸馏 LoRA，扩散模型推理从 23 秒压到 2 秒

> 原标题：SenseNova-U1开源8步蒸馏LoRA，扩散模型推理提速11倍

- 来源：AI HOT 精选
- 发布时间：2026-05-07T15:02:17.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/16387
- 原文：https://x.com/berryxia/status/2052403652674093166

## 摘要

商汤把扩散模型常用的 100 步生成流程蒸馏到只剩 8 步，GPU 上跑一张图从 23 秒降到 2 秒，快了 11 倍。做法是训了一个 LoRA 权重，直接挂到模型上就能用，不用改原模型结构。配套给了 ComfyUI 工作流，覆盖文生图、改图和交错生成。正文没提具体画质对比和什么显卡跑的，这点先别太激动。核心信号不是参数堆得多大，而是用蒸馏换延迟，让扩...

## 推荐理由

我会先打个折：这只是图像生成领域的推理加速，不是通用模型突破，所以放在featured而不是P1。但它的钩子很实在——用8步蒸馏LoRA把扩散模型从100步砍到8步，GPU推理从23秒压到2秒，还直接支持ComfyUI。对干活的人来说，这意味着同样的卡能多跑十几倍的图，或者低配机器也能玩。正文没披露蒸馏用了多少样本、LoRA参数量多大，这点先别太激动，但开源这一步本身就让验证成本很低。

## 锐评

这条消息的核心是蒸馏换速度，不是参数堆得多大。商汤训了一个LoRA权重，直接挂到原模型上就能把生成步数从100步砍到8步，GPU跑一张图从23秒降到2秒，快了11倍。配套给了ComfyUI工作流，文生图、改图、交错生成都能用，对做实时应用的人比较友好。

但正文没披露几个关键信息：画质损失多少、在什么显卡上测的、跟其他蒸馏方案比有没有优势。23秒到2秒这个数字如果是在高端卡上跑出来的，换到消费级卡上可能没那么夸张。另外只训LoRA不改原模型结构，意味着上限受原模型限制，不是从底层重新设计推理路径。

还缺一组对比：8步生成的结果跟100步比，细节、构图、文字渲染这些硬指标差多少。如果画质掉得不多，这个方案对需要低延迟的场景确实省钱省算力。
