# 对 AI 拒绝请求能力的信任为何过度

> 原标题：We’re putting too much faith in AI’s ability to say no

- 来源：MIT Technology Review · AI
- 发布时间：2026-10-09T09:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/akzt6u4sk2yrxos68w48v2vba
- 原文：https://www.technologyreview.com/2026/10/09/1145728/we-are-putting-too-much-faith-in-ai-to-say-no/

## 摘要

AI 的拒绝机制已成为安全防护的主要支柱，但其概率性失效、过度拒绝和隐蔽拒绝可能带来伤害、审查与失控风险。文章结合研究和访谈指出，拒绝训练及外围分类器无法消除模型已有的危险能力，收紧防护也会阻碍合法研究；Anthropic 曾表示，一类分类器使聊天机器人的计算成本增加了 24%。
