# Meta 发布 Muse Spark 1.3：更会写代码、更擅长处理长流程任务

> 原标题：Introducing Muse Spark 1.3

- 来源：Hacker News 首页
- 发布时间：2026-09-02T19:25:47.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/54361
- 原文：https://research.meta.ai/blog/introducing-muse-spark-1-3

## 摘要

Meta 今天在 Muse Code 和自家 API 上线了新模型 Muse Spark 1.3。它主要强化了两件事：一是写代码和当“数字员工”干活的能力，二是处理那种步骤多、容易跑偏的长任务。具体来说，这个模型现在会在指令模糊时主动问你，卡住了会求助，要执行重要操作前会先跟你确认。跑分上，它在智能体、编程、指令遵循和长文本理解这几个项目里，都超过了自...

## 推荐理由

Meta 发了 Muse Spark 1.3，主打写代码和当数字员工干活，跑分在几个关键项上压过了 GPT 5.6。我会先打个折——这还是个迭代版本，不是新架构，而且最高推理模式正文没细说，所以没给到 85 分以上。但三个交互机制（反问、求助、确认）让智能体部署更靠谱，对从业者来说信息量够，值得放在 featured 位置。

## 锐评

这次更新最实在的地方，是让模型更像一个能跟你配合的同事，而不是一个闷头执行指令的黑箱。它会在指令模糊时反问，卡住了会求助，执行重要操作前会先跟你确认。这解决了长任务里最烦人的问题：模型跑偏了你还不知道，最后给一堆没法用的结果。从演示看，它能从 CAD 文件和仿真数据里直接生成一份 PDF 报告，或者在多轨录音里修贝斯的错误，说明它开始能处理“从文件到成品”这种多步骤的活了。

跑分上，Meta 说它在智能体、编程、指令遵循和长文本理解上都超过了 Muse Spark 1.2、GPT 5.6 Sol 和 Opus 5 的最高配版本。但这里要打个折：正文没披露具体的测试集和评分标准，只给了一张柱状图，没法判断领先幅度在实际场景里有多大意义。另外，最强的推理模式还在做安全测试，现在上线的版本能力是打了折扣的。

还缺什么？没提模型规模、推理成本和延迟。这种主动确认和求助的行为，在实际业务流程里会不会因为频繁打断而拖慢效率，也需要真实用户反馈来验证。
