跳到正文
TechCrunch · AI

Stability AI 发了新音频模型,最长能生成六分多钟的歌

Stability AI releases a new audio model that can create 6-minute songs

Stability AI 推出了 Stable Audio 3.0 系列,一共四个模型。最小的两个(4.59 亿参数)能在设备本地跑,生成两分钟的音乐或音效;中等(14 亿参数)和大杯(27 亿参数)模型则能生成 6 分 20 秒的完整曲子,比 2024 年的 2.0 版长了一倍多。小、中杯模型都开放权重,可以随便用和改。不过正文没提训练数据来源、生成...

推荐理由:我会先打个折:标题的 6 分钟和正文的 2 分钟对不上,正文没解释这个差距,所以别太激动。但端侧能跑出 2 分钟音轨这件事本身挺省钱,对做音频工具的人是个信号。整体算中等偏轻的产品更新,靠标题的钩子和端侧成本点撑到 featured 门槛。

读原文 ↗导出 Markdown