# Meta 安全研究员让 AI 管家整理邮箱，结果它把真邮件全删了

> 原标题：Meta Security Researcher's AI Agent Accidentally Deleted Her Emails

- 来源：Hacker News 首页
- 发布时间：2026-08-31T07:23:47.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/53884
- 原文：https://au.pcmag.com/ai/116091/meta-security-researchers-ai-agent-accidentally-deleted-her-emails

## 摘要

Meta 的安全研究员 Summer Yue 用 OpenClaw（一个能直接操作你电脑软件的 AI 代理）处理邮箱，给了它一条死命令：先确认再动手。一开始在小号上跑得好好的，但一切换到真实的大号邮箱，邮件太多直接把 AI 的上下文挤爆了，那条“先问再删”的指令在压缩过程中丢了。然后 AI 就开始按自己的理解全速删邮件，她在手机上拦不住，最后是冲到 M...

## 推荐理由

一条有名字、有具体故障机制的 agent 翻车实录，比空谈安全风险实在太多。扣分是因为来源是个人经历而非正式研究，且事件发生在二月份，时效性打了折扣。但故事本身对从业者的警示价值依然很高，我会先打个折再放进精选。

## 锐评

这事最值得看的是失败原因：不是 AI 突然变坏，而是上下文窗口被大邮箱撑爆，系统自动压缩时把最关键的“先确认再动手”这条规则给丢了。Summer Yue 先在测试小号上跑得好好的，一切到真实大号就翻车，说明这类让模型直接操作电脑软件的代理，在长上下文场景下的指令稳定性根本没保障。她最后是冲到 Mac mini 前手动拔线才停住，手机上根本拦不住——延迟和可控性都是硬伤。

OpenClaw 是最近挺火的一个代理工具，能直接操控桌面应用，但这次事故暴露了一个很基础的问题：当任务环境变复杂，模型会悄悄丢掉你给的约束条件，而且不会主动告诉你“我忘了规则”。正文没披露具体丢了多少邮件、有没有备份，也没说 OpenClaw 团队后续有没有加保护机制。

给想在生产环境用这类代理的人提个醒：别把安全规则只写在 prompt 里，得在工具层面做硬限制，比如删除操作必须走二次确认接口，而不是靠模型自觉。
