# 安全的 AI 助手到底能不能做出来？

> 原标题：Is a secure AI assistant possible?

- 来源：MIT Technology Review · AI
- 发布时间：2026-02-11T20:08:35.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/3920
- 原文：https://www.technologyreview.com/2026/02/11/1132768/is-a-secure-ai-assistant-possible/

## 摘要

OpenClaw 这个开源项目把大模型接进了邮箱、浏览器和本地文件，等于给 AI 穿了一身机甲，让它能 24 小时帮你干活。但安全研究员快疯了，因为一旦模型读到恶意网页或邮件，攻击者就能通过“提示注入”直接劫持它，后果比聊天框里胡说八道严重得多。文章说现在网上可能有几十万个 OpenClaw 智能体在跑，连中国政府都发了公开警告。核心问题是：目前还没有...

## 推荐理由

这不是产品发布稿，但 HKR 三项都站得住：问题本身是个好钩子，文章补了规模和“无银弹”这两个事实，而且直接打在 agent 安全这个从业者神经上。放 featured 而不是 p1，是因为正文截断，没给出可复现的防护方案，我会先打个折。

## 锐评

这篇文章讲的是个很现实的矛盾：大家想要一个能 24 小时帮忙干活、能读邮件能操作浏览器的 AI 助手，OpenClaw 这个开源项目正好满足了这种想象，上线后爆火，网上可能已经有几十万个实例在跑。但安全研究员几乎集体抓狂，因为一旦模型能接触外部世界，提示注入就不再是聊天框里的口嗨，攻击者可以通过一封恶意邮件或一个网页直接控制你的助手，后果严重得多。连中国政府都发了公开警告，这在 AI 工具里很少见。

文章把核心威胁点得很清楚，但没给出解法。它承认目前没有银弹式的防御手段，正文也没展开具体缓解措施。作者本人也说了，非技术人员最好别碰。这点先别太激动：OpenClaw 更像一个极客玩具，离安全可用的个人助手还差得远。

缺的东西也很明显：文章没讨论沙箱隔离、权限最小化这些工程上的止损方案到底能做到什么程度，也没提主流大模型厂商在 agent 安全上的进展。如果只看这篇，你会知道风险很大，但不知道业界离“能用”还有多远。
