Anthropic 公开 Claude 文本水印方案:靠选词时的随机数做手脚,不留隐藏字符
How Claude's text watermarking works
Anthropic 说,以后的 Claude 模型会在生成的文字里埋一个水印,主要是为了满足欧盟 AI 法案的要求。这个方案用的是 Google DeepMind 的 SynthID-Text 思路:模型在挑下一个词的时候,如果几个候选词意思差不多、选谁都行,它本来靠一个随机数来决定。水印就是把随机数的来源换掉,改成用一段密钥加上前文几个词来算,这样整...
推荐理由:Anthropic 头一回把 Claude 的水印方案掰开揉碎讲清楚,SynthID-Text 的实现细节给得很足,所有靠 Claude 输出吃饭的人都该看一眼。没给 85 分是因为这更像合规说明书,不是能力升级,而且水印检测的准确率正文没给具体数字,这点先别太激动。