← 返回今日精选
重要行业应用85

Anthropic 详解 Claude 文本水印方案:基于 SynthID-Text,超过 200 词自动嵌入

据 The Indian Express 报道,Anthropic 披露了 Claude 文本水印的更多细节:未来模型生成的超过 200 个 token(约 150 词)的文本将携带机器可读水印,人工无法察觉,复制粘贴或编辑后仍可能保留。该方案基于 Google DeepMind 的 SynthID-Text 研究,旨在履行欧盟 AI Act 第 50(2) 条的透明度义务。

据 The Indian Express 报道,Anthropic 分享了其对 Claude 生成文本添加水印计划的更多细节。未来 Claude 模型生成的任何超过 200 个 token(约 150 词)的文本都将携带机器可读的水印,人类读者无法察觉,且无法通过复制粘贴移除,甚至在内容被编辑后仍可能保留。此外,AI 生成的图像文件将附带加密签名的来源数据。

该水印技术基于 Google DeepMind 于 2024 年发表的 SynthID-Text 研究论文。其原理是:大语言模型在生成每个 token 时会基于前文从概率较高的选项中半随机采样,水印机制通过密钥影响这一采样过程,使选词序列留下可检测的模式。持有密钥者可以检查 token 序列是否与 Claude 使用该密钥时的选择一致,从而判断文本是否由 Claude 生成。

报道指出,该方法不涉及在文本中隐藏不可见的 Unicode 字符(如早期一些猜测所述),不会影响模型的速度和 token 消耗,水印中也不包含可将文本关联到用户、组织或会话的个人身份信息。使用 Claude 进行的翻译文本同样会携带水印。

Anthropic 此举是为了遵守于 2026 年 8 月 2 日生效的欧盟 AI Act 第 50(2) 条的透明度法律义务。Anthropic 表示正在开发水印检测 API,预计在未来几个月内推出,现有 Claude 模型生成的内容也将在未来几个月内携带隐藏水印。

编辑部解读

为什么值得关注

文本水印成为合规刚需,Anthropic 采用密钥式 SynthID 方案平衡可检测性与输出质量,但围绕措辞精确性的争议仍在持续,检测 API 的开放将影响出版与内容平台。