# 商汤把 SenseNova-U1 的训练代码全开源了，一个框架同时训生图、修图、交错生成和理解

> 原标题：SenseNova-U1全训练代码开源，支持多模态多任务训练

- 来源：AI HOT 精选
- 发布时间：2026-05-26T14:58:16.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/28019
- 原文：https://x.com/SenseTime_AI/status/2059288013994406013

## 摘要

OpenSenseNova 在 GitHub 上放出了 SenseNova-U1 的完整训练代码，用 Apache-2.0 协议。代码覆盖了 8B 稠密模型和 A3B MoE（混合专家）架构，在一个统一框架里支持四种多模态任务：文生图、图片编辑、图文交错生成，以及文本与视觉理解。工程上为大规模训练做了准备，支持混合并行、流式可恢复的数据管线、用环境变量...

## 推荐理由

这条消息的卖点是“完整训练代码开源”，不是常见的只放权重。8B 密集和 A3B MoE 两种模型规格都给了，Apache-2.0 协议也干净。不过正文没披露训练用了多少数据、多少算力，也没有任何评测结果，所以实际效果和训练成本现在没法判断。我会先打个折：代码开源本身值得关注，但别急着对标闭源模型，等社区跑出结果再说。

## 锐评

商汤这次放出的不是模型权重，而是完整训练代码，Apache-2.0 协议，对想复现或魔改多模态训练流程的团队比较实用。代码覆盖了 8B 稠密模型和 A3B MoE（混合专家，用多个小专家网络分工处理不同输入，推理时只激活一部分，省算力）两种架构，在一个框架里同时支持文生图、图片编辑、图文交错生成和文本视觉理解四类任务。工程上做了混合并行、流式可恢复数据管线这些大规模训练的标配，宣称能从单机 8 卡扩展到多节点集群。

但正文没提模型性能基准测试结果，也没给权重文件，你没法直接跑起来看效果。开源代码和开源模型是两回事，这点先别太激动。另外，训练数据来源和规模也没披露，复现时数据这块得自己想办法。如果后续能补上技术报告和权重，对社区的价值会大很多。
