# OpenAI 发布 Operator 系统卡：一个能替你操作电脑的智能体，但高风险操作会强制让人确认

> 原标题：Operator System Card

- 来源：OpenAI News
- 发布时间：2025-01-23T10:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/646
- 原文：https://openai.com/index/operator-system-card

## 摘要

OpenAI 在 2025 年 1 月 23 日公开了 Operator 的安全评估报告。Operator 是一个能看懂屏幕截图、像人一样点击按钮和菜单的电脑操作智能体，底层结合了 GPT-4o 的视觉能力和强化学习训练出的推理纠错能力。它能帮你在浏览器里订菜、买票、填表，但也会引入新风险，比如被第三方网页里的恶意指令误导（提示注入攻击），或者自己操作...

## 推荐理由

这篇系统卡不是产品发布稿，而是安全说明书，但信息密度够高。我会先打个折：它只是 Operator 的配套文件，不是主产品公告，所以 featured 定位合理。真正值得看的是两件事：一是 OpenAI 把部署门槛定在缓解后 Medium 以下，这等于公开承诺了一个可验证的安全基线；二是高风险任务的处理很具体——金融交易、发邮件、删日程需要关键步骤确认，买卖股票直接封死。这些细节比泛泛的“安全第一”有用得多。说服力评 Medium 也值得留意，说明模型在影响人的决策上已经有一定能力，但还没到高危。整体事实清楚，没有发现错误或过时信息，对从业者判断 C...

## 锐评

这份安全卡讲的是 Operator 上线前的安全体检，不是产品功能介绍。Operator 是个能看屏幕截图、像人一样点按钮的电脑操作智能体，底层用 GPT-4o 的视觉能力加强化学习训练出来的推理纠错。它能帮你在浏览器里买菜、订票、填表，但也会引入新麻烦，比如被第三方网页里的恶意指令误导，或者自己操作出错不好撤回。

OpenAI 按自己的 Preparedness Framework 给 Operator 打了分：生化武器、网络安全、模型自主性三项都是低风险，说服能力是中风险。他们的硬规矩是，只有缓解后评分在中等或以下的模型才能部署，Operator 刚好踩线过。安全手段主要靠两层：一是让模型直接拒绝高风险任务，二是在关键步骤弹确认框让用户拍板。涉及钱、发邮件、删日历项的操作都要用户确认，股票交易则完全封死。

正文没披露缓解前后的具体评分变化，也没说红队测试里发现了哪些具体攻击案例、成功率多少。这些缺口让人没法判断“中等”这个分数是真实水平还是卡着线过的。另外，模型犯错后怎么回滚操作、用户确认机制会不会被频繁弹窗搞到麻木，这些实际体验问题也没展开。
