Stability AI 发布 Stability Audio 3.0,能生成超过 6 分钟的专业歌曲
Stability AI 发了四个新音频模型,最小的两个(4.59 亿参数)能在手机或电脑本地跑,生成两分钟以内的声音和音乐。中型(14 亿参数)和大型(27 亿参数)模型能把完整歌曲拉到 6 分 20 秒,比上一代翻了一倍多。小号和中号模型已经开源,大号模型只走 API 和付费托管,年收入超 100 万美元的公司必须买商业授权。训练数据来自华纳和环球...
推荐理由:我会先打个折:标题里的“专业级”正文没给出任何评判标准或盲测结果,这点先别太激动。能生成超过6分钟的音乐确实比多数短片段模型进了一步,4款规格也说明在考虑不同算力场景。但全文没披露训练数据是否含版权素材、生成内容的商用条款,也没给任何客观音质指标,所以只能算一次产品更新,离行业震动还差几口气。