跳到正文
Hacker News 首页

Anthropic 用 45 个 Claude 智能体组队挖漏洞、做游戏,发现协作一复杂就容易崩

Patterns and problems in emerging multi-agent systems

Anthropic 让 45 个 Claude 智能体在共享论坛里协作,去扫 15 个开源项目的漏洞。Mythos Preview 模型组队后花了 2700 万 token 找出 266 个漏洞,数量是独立单干模式的 10 倍多,但其中一半漏洞藏在独立模式没被要求扫描的目录里,两种方法共同发现的漏洞只有 12 个。组队的智能体会自己造工具、按漏洞类型分...

推荐理由:Anthropic 发了篇研究博客,用 Claude Mythos Preview 和 Opus 4.8 跑了一次大规模多智能体找漏洞实验。数字很实在:45 个智能体花了 2700 万 token 找出 266 个漏洞,还出现了自发造工具和分工。硬核、有料、可复现,三个维度都打中了。没给更高分是因为我们只拿到摘要,缺完整论文里的细节和验证。

读原文 ↗导出 Markdown