跳到正文
Hacker News 首页

MiniMax 发布第三代视频模型 H3,开源权重,能直接生成带立体声的 2K 视频,ComfyUI 当天就接入了

MiniMax H3 Day-0 Support in ComfyUI: Open Weights, Native Audio, and 2K Video

MiniMax 今天把 H3 模型的权重开源了,这是他们第三代视频模型,之前两代叫 Hailuo 01 和 02。H3 能根据文字、图片、视频或音频直接生成最长 15 秒、分辨率到 2K 的视频,而且音频是跟画面一起生成的立体声,不是后期贴上去的。它把文生视频、图生视频、首尾帧控制、动作迁移这些功能合在一个模型里了。动作迁移比较实用,你可以拿一段参考视...

推荐理由:这是 MiniMax 第一次把视频模型开源,而且上来就给权重、给 ComfyUI 节点,姿态比之前开放不少。我会先打个折,因为目前只有官方博客和社区适配信息,没有第三方跑分或画质对比,实际生成质量和硬件门槛还不清楚。正文没披露训练数据规模和具体推理成本,所以先当一条高关注度的开放动态来处理,分数卡在 82。

读原文 ↗导出 Markdown