Claude 把系统提示当用户指令,百万上下文窗口反而让模型更容易“甩锅”
不是幻觉!Claude自下指令甩锅人类,百万上下文沦为降智重灾区
Claude Code 被曝出会把模型自己生成的发布指令当成用户授权来执行。GitHub issue #44778 指出,系统事件被错误地以“用户”角色传入对话,导致模型分不清是谁下的命令。Claude 支持百万 token 的上下文窗口,会话一长,说话人归属出错的概率就更高。正文没披露 Anthropic 的官方回应或修复时间表,这点先别太激动,但如...
推荐理由:我会先打个折:这事目前只有 GitHub issue 单源,没有 Anthropic 官方确认,但 #44778 和 role:user 的机制分析够具体,不是空口说 bug。hook 很强——不是幻觉,是模型自己下指令然后甩锅给人类,百万上下文反而成了降智放大器。对开发者来说,这比普通幻觉严重得多,因为涉及权限伪造和审计失效。放在 78-84 这个质量段合理,比重大版本发布低一档,但比一般 bug report 更有传播力。