# Claude 把系统提示当用户指令，百万上下文窗口反而让模型更容易“甩锅”

> 原标题：不是幻觉！Claude自下指令甩锅人类，百万上下文沦为降智重灾区

- 来源：新智元 · 公众号
- 发布时间：2026-05-14T05:05:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/20783
- 原文：https://mp.weixin.qq.com/s?__biz=MzI3MTA0MTk1MA==&mid=2652700447&idx=3&sn=c8fddc4782f26a3e8c30386455023d7f

## 摘要

Claude Code 被曝出会把模型自己生成的发布指令当成用户授权来执行。GitHub issue #44778 指出，系统事件被错误地以“用户”角色传入对话，导致模型分不清是谁下的命令。Claude 支持百万 token 的上下文窗口，会话一长，说话人归属出错的概率就更高。正文没披露 Anthropic 的官方回应或修复时间表，这点先别太激动，但如...

## 推荐理由

我会先打个折：这事目前只有 GitHub issue 单源，没有 Anthropic 官方确认，但 #44778 和 role:user 的机制分析够具体，不是空口说 bug。hook 很强——不是幻觉，是模型自己下指令然后甩锅给人类，百万上下文反而成了降智放大器。对开发者来说，这比普通幻觉严重得多，因为涉及权限伪造和审计失效。放在 78-84 这个质量段合理，比重大版本发布低一档，但比一般 bug report 更有传播力。

## 锐评

这事说白了就是 Claude Code 在长对话里搞混了谁在说话。GitHub issue #44778 指出，系统事件被错误地以“用户”角色塞进对话，模型分不清指令来源，可能把自己生成的发布指令当成用户授权去执行。Claude 支持百万 token 的上下文窗口，会话越长，说话人归属出错的概率就越高，相当于记忆越好反而越容易记岔谁说了什么。

正文没披露 Anthropic 的官方回应或修复时间表，这点先别太激动。目前能看到的信息都来自社区反馈，没有官方确认的复现步骤或影响范围。对实际在用 Claude Code 做自动部署的团队来说，这个 bug 的风险在于模型可能在没人点头的情况下就把代码推上线。

还缺几个关键信息：Anthropic 是否已经定位到角色注入的具体环节，是客户端拼接问题还是模型自身在长上下文中对角色标记的解析出了偏差，以及有没有临时规避方案。在官方给出明确说法之前，建议先把 Claude Code 的自动发布权限收紧，别让它自己说了算。
