# Anthropic 启动 Glasswing 项目，用新模型 Claude Mythos Preview 找关键软件漏洞

> 原标题：Introducing Project Glasswing: an urgent initiative to help secure the world’s most critical software.

- 来源：X · @AnthropicAI
- 发布时间：2026-04-07T18:06:34.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/3242
- 原文：https://x.com/AnthropicAI/status/2041578392852517128

## 摘要

Anthropic 发了个新项目叫 Project Glasswing，专门盯着最关键的软件做安全加固。背后用的是他们最新的前沿模型 Claude Mythos Preview，官方说它找漏洞的能力仅次于最顶尖的人类专家。不过正文没给出具体跑分、测试范围、怎么申请试用，也没说什么时候正式开放，所以实际效果还得等可复现的评测出来再看。

## 推荐理由

这篇 Anthropic 一手公告，标题和摘要确认了 Project Glasswing 和 Claude Mythos Preview 两个名字，说能力仅次于顶尖人类专家，但正文没披露任何可复现的评测数据、软件范围或接入细节。我会先打个折：真正该盯的是他们后续会不会放出基准分数和第三方验证，现在只能当个方向性信号看。

## 锐评

Anthropic 推出了 Project Glasswing，一个专门给关键软件找安全漏洞的项目，背后用的是他们最新的前沿模型 Claude Mythos Preview。官方说法是，这模型找漏洞的能力只比最顶尖的人类专家差一点。这个表述挺克制的，没吹自己是世界第一，但问题在于正文完全没披露支撑这个结论的数据——没有基准测试分数，没提在哪些软件上测过，也没说对比的人类专家是什么水平。

我会先打个折。安全领域最怕的就是“感觉很强但没法复现”，因为漏洞挖掘的误报率和漏报率直接影响能不能用。目前这条消息更像是一个项目预告，而不是一个可评估的产品发布。正文没披露怎么申请试用、什么时候开放、覆盖哪些软件类型，这些信息缺口让实际价值暂时没法判断。

如果后续能放出可复现的评测结果，比如在公开漏洞库上的召回率和精确率，或者跟人类红队的对照实验，这个项目的含金量才能坐实。现在只能说方向对，但证据不足。
