跳到正文
AI HOT 精选

MiniMax 发布开源模型 H3,能直接生成带原生立体声的 2K 视频

MiniMax H3 发布:开源全能多模态生成模型,支持 2K 原生立体声视频

MiniMax 推出了一个叫 H3 的多模态生成模型,把文字、图片、视频和音频的理解都塞进了一个模型里。它能直接生成最长 15 秒、带原生立体声的 2K 视频。公司给出的价格挺有竞争力:2K 视频每秒的价格不到主流模型的三分之一,768p 的价格也比主流 720p 便宜一半以上。模型权重计划在几天内开源,但公告没提具体用哪种开源协议,也没说确切日期,只...

推荐理由:MiniMax 发了 H3,一个把文、图、视频、音频塞进同一个模型的多模态生成模型,能直接出最长 15 秒、带原生立体声的 2K 视频。定价上,2K 每秒不到主流模型的三分之一,768p 也比主流 720p 便宜一半以上,省钱信号很明确。权重计划几天内开源,但公告没写具体协议和确切日期,这点先别太激动。整体看,一个模型打通多模态生成,加上激进定价和开源动作,对做视频生成的人来说是值得马上看一眼的更新。

读原文 ↗导出 Markdown