跳到正文
X · @Yuchenj_UW

Meta 放出 Avocado 模型,内部叫 Muse Spark,训练成本比 Llama 4 Maverick 省了十倍以上

Meta released Avocado, they call it Muse Spark.

Meta 的 TBD 实验室用 9 个月重写了整套预训练流程,做出了 Avocado(对外叫 Muse Spark)。正文说它的能力跟 Llama 4 Maverick 差不多,但训练用的算力不到后者的十分之一。模型没开源,也没公布参数量、跑分成绩和发布时间。这件事真正的看点是训练基础设施的效率,不是改个名字。

推荐理由:我会先打个折:正文没披露参数量、评测集和发布时间,目前只是一条帖文,别当正式发布看。但信息量够硬——TBD lab 用 9 个月重建预训练栈,把训练算力压到 Llama 4 Maverick 的十分之一以下,能力还接近,这对算力成本敏感的人是个信号。Meta 把它叫 Muse Spark,不是开源模型,所以重点不在命名,而在基础设施效率。HKR 全过,给 74 分,因为缺关键参数,验证还弱,但省钱的故事本身够吸引从业者盯后续。

读原文 ↗导出 Markdown