如果你用过 Claude,最近一段时间应该注意到过一个细节:它的回答文本里偶尔会藏着一些"看不见的标记"——肉眼读不出来,但统计上能识别出"这段文字大概率是 AI 写的"。这其实就是所谓的文本水印(text watermarking),通过在 token 选样的概率分布里悄悄塞入偏好信号实现,不影响阅读体验,但能被专门检测器抓出来。
之前 Anthropic 只有新模型 Claude Opus 4.1 默认开启了这个能力。这次官方的表态很直接:把水印扩展到老模型。换句话说,不管你用的是哪个版本的 Claude,理论上它的输出都会带上可追溯的"指纹"。这并不是一个无害的细节,对整个 AI 内容生态冲击不小。
为什么这事值得说一说?
阅读全文