# OpenAI 发布 Deep Research 系统卡，披露安全测试与风险评级

> 原标题：Deep research System Card

- 来源：OpenAI News
- 发布时间：2025-02-25T10:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/618
- 原文：https://openai.com/index/deep-research-system-card

## 摘要

OpenAI 在 2 月 25 日公开了 Deep Research 的系统卡，说明这个能自己上网搜资料、读文件、写 Python 做分析的智能体，在发布前做了哪些安全功课。他们按内部准备框架给四个高风险领域打了分：生化核辐射风险、网络安全、说服能力和模型自主性，四项都是“中等”。OpenAI 的规矩是，只有风险缓解后不高于“中等”的模型才能上线，所以...

## 推荐理由

OpenAI 官方系统卡，有明确的部署门槛、6 类风险拆解和 4 个 Preparedness Medium 评级，HKR 三项都踩中了。没给 P1 是因为这更像现有产品的安全交底，不是新模型发布，而且样本量和通过率都没披露，验证强度存疑。

## 锐评

这份系统卡说白了就是 OpenAI 在告诉你：Deep Research 这个能自己上网扒资料、读 PDF、写 Python 做分析的智能体，我们查过了，暂时没发现大毛病。他们按内部框架给生化核辐射、网络安全、说服能力和模型自主性打了分，四项全是“中等”。按 OpenAI 自己的规矩，风险缓解后不高于“中等”才能上线，所以它刚好过关。

但报告里缺的东西也很明显。它没公布具体测试集有多大、通过率是多少，只说用了早期版 o3 模型，针对网页浏览做了优化。这就好比告诉你“考试及格了”，但不给你看卷子和分数。另外，他们提到模型上网时可能撞上恶意指令，做了额外训练来抵抗，但具体怎么训的、效果量化到什么程度，正文也没展开。

我会先打个折：这份报告更像一份合规声明，而不是深度技术审计。它确认了最底线安全，但如果你想评估这个智能体在真实场景里翻车的概率，目前的信息还不够。
