Claude 文本水印如何运作?

How Claude's text watermarking works

Claude 文本水印如何运作?

为符合欧盟 AI 法案,Claude 将引入文本水印技术。这项技术通过在模型生成文本时,利用密钥改变随机选词的来源,在文中植入人类无法察觉但可被检测的模式。水印不会影响输出质量、不增加额外 token、不暴露用户隐私,也不会改变文本的可读性。它仅能判断文本是否由 Claude 生成,无法区分是原创还是重度编辑。对于代码等需要精确输出的内容,水印应用较少。Anthropic 将提供检测 API,并计划为旧版模型逐步添加此功能。

水印不会改变读者阅读时的意义或体验,但如果你事后想确认这段文本是否很可能由 Claude 生成,水印就能帮你做到这一点。
  1. absoluteunit1

    > Google DeepMind 通过向部分 Gemini 流量提供带有水印的模型,并对比点赞和点踩的评分,测试了这种水印的影响。他们发现,与未加水印的模型相比,统计上并无显著差异。在一项对照研究中,人类评估者并排对比加水印和未加水印的回答时,也未发现质量上的区别。

    不知为何,我原本以为测试这一点的做法会比单纯检查点赞/点踩数据和用户的“感觉”更复杂一些。

  2. pr337h4m

    我们非常幸运,开源模型在几乎所有非编程用例上已经达到了同等水平。

  3. arjie

    很有意思。以下是欧盟法案中强制要求这一点的条款:

    > 提供生成合成音频、图像、视频或文本内容的 AI 系统(包括通用 AI 系统)的提供商,应确保 AI 系统的输出以机器可读格式进行标记,并可被检测为人工生成或篡改。提供商应确保其技术解决方案在技术上可行的情况下是有效的、可互操作的、稳健且可靠的,同时考虑到各类内容的具体特性和局限性、实施成本以及公认的最先进水平(相关技术标准可能对此有所反映)。如果 AI 系统仅执行标准编辑的辅助功能,或未实质性改变部署者提供的输入数据或其语义,或经法律授权用于检测、预防、调查或起诉犯罪,则本义务不适用。

    https://eur-lex.europa.eu/eli/reg/2024/1689/2026-07-27/eng

    这肯定让 Pangram 的工作轻松了一些。

  4. jluysvi

    Opus 5 肯定是试点项目,因为它的写作风格太令人抓狂了,这肯定是刻意为之。希望他们未来能做得更隐晦一些。

  5. WaitWaitWha

    有没有办法让非欧盟用户选择退出?我在文章里没看到这样的选项。

同日更多故事

2026-08-14