# OpenAI 发布 o3-mini 系统卡：整体风险定级为“中”，模型自主性首次达到“中”

> 原标题：OpenAI o3-mini System Card

- 来源：OpenAI News
- 发布时间：2025-01-31T11:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/640
- 原文：https://openai.com/index/o3-mini-system-card

## 摘要

OpenAI 给 o3-mini 的最终安全评分是“中”等风险，其中在生化核辐射、说服力和模型自主性这三项上都是“中”，网络安全是“低”。这是 OpenAI 第一个在“模型自主性”上拿到“中”的模型，主要因为它的编程和研究工程能力更强了。但别急着慌，系统卡里说它在“现实世界机器学习自我改进”的测试里表现还很差，没达到“高”风险的门槛。OpenAI 的规...

## 推荐理由

这是 OpenAI 官方的系统卡，不是日常宣传稿。我会先打个折：正文没给具体的基准分数，所以它算不上那种炸裂的模型发布。但它把 o3-mini 的部署后总体风险定在 Medium，模型自主性也首次到了 Medium，还明说了部署要求不高于 Medium、继续开发不高于 High——这些门槛本身比一个孤零零的分数更有看头。对从业者来说，知道模型现在踩在哪条线上，比单纯看跑分更实在。

## 锐评

o3-mini 的安全评分是“中”，在生化核辐射、说服力和模型自主性这三项都是“中”，网络安全是“低”。按 OpenAI 自己的规矩，“中”及以下才能上线，所以它拿到了部署许可。

最值得看的是“模型自主性”首次被评为“中”。这主要因为它的编程和研究工程能力变强了，但系统卡里也明说，它在“现实世界机器学习自我改进”的测试里表现还很差，没摸到“高”风险的门槛。换句话说，它现在更像一个很能写代码的助手，而不是能自己迭代升级的 AI 研究员。

不过，这份系统卡没给出具体的基准测试分数，只说“达到最先进水平”。外部红队测试的细节也没展开，我们不知道它在哪些具体场景下翻了车。想评估实际风险，这些缺口是关键。
