# OpenAI 发布 o3 和 o4-mini 系统卡，两款模型在生物化学、网络安全和 AI 自我改进三项风险上均未触及“高”门槛

> 原标题：OpenAI o3 and o4-mini System Card

- 来源：OpenAI News
- 发布时间：2025-04-16T10:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/579
- 原文：https://openai.com/index/o3-o4-mini-system-card

## 摘要

OpenAI 在 4 月 16 日公布了 o3 和 o4-mini 的系统卡。这两款模型把推理能力和全套工具（比如网页浏览、跑 Python 代码、分析图像和文件）结合到了一起，解复杂数学题、写代码或处理科学任务时，可以在思考过程中直接调用这些工具来帮忙。安全方面，这是 OpenAI 第一次按第二版预备框架来评估。他们的安全顾问组审查后认为，o3 和 ...

## 推荐理由

这篇系统卡是 OpenAI 自己发的，给 o3 和 o4-mini 补上了能力和安全细节。两个模型现在能上网、跑 Python、分析图像和文件，等于把工具链装全了。安全评估按 Preparedness Framework V2 走，Safety Advisory Group 给的结论是：生化、网络安全、自我改进这三项风险都没到 High。我会先打个折——系统卡本身不披露具体测试数据和失败案例，所以“没到 High”这个判断只能先收下，别太激动。对从业者来说，关键信息是工具权限全开后的安全评级，这直接影响能不能在企业环境里落地。

## 锐评

OpenAI 这次把推理模型和工具直接绑在了一起，o3 和 o4-mini 在思考过程中就能调用网页浏览、Python 代码、图像分析这些功能，不用像以前那样等模型输出完再手动喂工具。安全方面，这是第一次按第二版预备框架来评估，安全顾问组审查后认为，两个模型在生物化学、网络安全和 AI 自我改进这三个跟踪类别里都没达到“高风险”门槛。

不过系统卡正文比较像一份合规声明，没放具体的基准测试分数、延迟数据或推理成本。模型到底比前代强多少、用工具时会不会更慢更贵，这些关键信息都没披露。另外，工具调用是在思维链里进行的，这会让行为更难审计——模型中间调了什么、搜了什么，外部不一定看得清。这点先别太激动，等有独立评测和实际跑分再说。
