# Claude Code 把自动模式设为默认，人工确认为什么常常只是盖章仪式

> 原标题：为什么人工确认常常只是盖章仪式？从 Claude Code 实测看 AI 时代的控制面迁移

- 来源：Computing Life · Share · 鸭哥调研
- 发布时间：2026-08-08T00:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/49570
- 原文：https://yage.ai/share/claude-auto-mode-approval-illusion-20260808.html

## 摘要

Anthropic 宣布从 8 月 14 日起，Claude Code 新会话默认开启 Auto Mode，不再逐条弹窗问你要不要执行命令，改由后台独立分类器实时判断风险。在 1053 名专业用户的盲测中，面对混入会话的危险命令，人工只拦住了 13.6%，分类器拦住了 89%。使用数据也显示，大家对单条命令的批准率高达 97%，但对多步计划的拒绝率有 ...

## 推荐理由

Anthropic 产品更新加一手实验数据，三个维度都打中了。1053 人盲测里 13.6% 对 89% 的拦截差距是硬钩子，97% 批准率和 49.5% 自我绕过率把“控制幻觉”坐实了。分数没给更高是因为正文没披露分类器误拦率，实际体验会不会变成另一种打断还不好说。

## 锐评

这条新闻最反直觉的地方在于：取消逐条确认弹窗，反而更安全了。Anthropic 拿出的 1053 人盲测数据很硬，面对混入会话的危险命令，人工只拦住了 13.6%，而独立分类器拦住了 89%。更关键的是，随着会话中弹窗次数超过 50 次，人工拦截率会从 17% 跌到 5%，这跟 1948 年 Mackworth Clock 实验里发现的注意力断崖式下跌完全吻合。

文章把这件事放在 Therac-25 放疗机事故、法航 447 空难等历史案例里看，讲清楚了同一个规律：当系统要求人类对 99% 无害的事件反复按确认时，这个动作就会从风险评估退化成肌肉记忆。Anthropic 自己的用户数据也佐证了这一点——单条命令批准率高达 97%，但多步计划的拒绝率有 39%，说明大家不是不关心安全，而是没精力逐条细审。

不过有几个信息缺口得指出来。第一，分类器 89% 的拦截率是在受控实验里测出来的，Apollo Research 的对抗测试显示漏报率仍有 7%，正文没说明这 7% 的漏报在真实生产环境里对应什么级别的风险。第二，文章提到 Auto Mode 会话的严重非预期伤害概率是 2.4%，低于手动审批的 6.3%，但没披露这个数据的样本量和统计显著性。第三，分类器做运行时判断需要调取完整环境上下文，这本身会不会引入新的延迟或权限暴露面，正文没有展开。如果是真的能在生产环境复现这个拦截率，那确实比让人当盖章机器强得多，但现阶段还是建议对高风险变更保留人工复核。
