Anthropic 发布了一篇博文,详细解释其聊天机器人 Claude 即将采用的文本水印技术。这一举措是为了遵守欧盟 AI 法案的透明度规范。此前 Anthropic 宣布该计划后,在 Reddit 和 X 上引发了不少用户争议,部分用户甚至声称要取消订阅。

水印的核心思路并不复杂:当 Claude 需要从多个同等合理的选项中选择措辞(例如用“overcast”还是“grey”来描述阴天)时,模型可以刻意制造一种统计模式。这种模式对读者完全不可见,但持有密钥的人可以检测出来。Anthropic 强调水印不会影响 Claude 的回复质量,有水印的文本与无水印的文本在阅读上毫无区别。具体实现上,Anthropic 采用的是 Google DeepMind 团队在 2024 年提出的 SynthID-Text 方案,并计划后续开放一个水印检测 API。
关于水印是否会被轻易绕过的关键问题,Anthropic 给出了清晰的边界:轻度编辑大概率无法完全消除水印,而彻底重写每个词则可以去除。但如果文本仅由 Claude 做轻量校对或润色(人类写了绝大多数词),水印能附着的内容就很少,几乎无法检测。对于代码,水印的作用更弱——因为生成可运行的代码时,模型没有在同样有效的选项之间自由选择的余地,因此水印几乎只体现在注释等任意性较强的部分,对实际代码没有实质影响。
Anthropic 还指出,其他主要模型开发者也已经签署了相同的实践准则,将各自实施自己的水印方案,因此 Claude 不会是唯一使用文本水印的聊天机器人。
更新时间:2026-08-17
本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828
© CopyRight All Rights Reserved.
Powered By 61893.com 闽ICP备11008920号
闽公网安备35020302035593号