AI 文本水印:藏在选词里的秘密

How AI text watermarking works

AI 文本水印:藏在选词里的秘密

纯文本没有像素,如何隐藏水印?Google 的 SynthID 和 Claude 的新模型给出了答案:水印不藏在字符里,而藏在模型生成时的“选词”概率中。通过密钥微调候选词的权重,AI 在生成每个词时都会留下统计痕迹。这种标记在复制粘贴后依然存在,但一旦文本被大幅改写,水印就会消失。检测并非依靠风格分析,而是需要持有密钥进行概率统计。这意味着水印证明的是“经过处理”,而非绝对的“AI 创作”。

它们看不见,能经受复制,之所以有效,是因为它们根本不存在于字符之中,而是存在于字符之间的选择里。
  1. wpasc

    最让我觉得疯狂的是(在我看来),我接触到的几乎所有人(纯属 anecdotal 数据)都讨厌 Claude 的写作风格。我在 Hacker News 的评论里看到过,和同事讨论时听到过,甚至和非技术背景的家人聊天时也聊到过。这风格简直糟糕透顶。现在看起来,这些怪癖似乎会以某种奇怪的方式被强制执行,以满足水印规则?

  2. gizmo686

    在一个只有少数几家 AI 提供商的世界里,这或许会有用。然而,在一个 AI 模型已成大宗商品的世界里,人们完全可以选用不提供水印的 AI 提供商,或者直接下载任何开源模型自己运行 [0]。

    我目前能看到的唯一实际用途,是防止模型坍塌。大多数使用 AI 的人并不在乎未来训练 AI 的人是否忽略他们的数据,因此他们没有动力切换到不提供水印的提供商。当然,这会阻碍该技术所有亲社会的应用,并可能导致大型提供商垄断“已知人类”数据,这具有严重的反垄断影响。

    [0] 注意,水印并非模型本身固有的,而是取决于模型如何运行。因此,提供开源权重模型的人无法使用这种技术。它必须由实际运行模型的人来使用。

  3. guessmyname

    我几乎从不复制粘贴 AI 生成的文本,我几乎总是手动转录,这反过来迫使我阅读 LLM 生成的内容,并让我有机会在过程中替换词汇。这显然无法规模化,尤其是如果你的影响力是通过实现的软件功能数量来衡量的话。但对于更有经验的工程师(Staff、Principal 及以上级别),他们通常是根据全公司倡议的成功与否来评估的,我认为这是最佳做法。

  4. throwatdem12311

    新职业点子:雇佣人类重写/总结并手动输入/转录 AI 输出,以去除水印。他们使用字典和同义词词典等“工具”,充分修改文本,使其不再符合 AI 的分布模式。那些能够写出显著“有机”文本的人类,将能以此谋得丰厚收入。

  5. techjamie

    我想知道这是否会成为提供商的新收入来源。想知道某段文本是否由 Claude 生成?有一个免费的网页表单可以粘贴进去。

    当然,如果你支付一些 API 费用,也可以运行自己的检查服务,这些检查对用户来说可能更方便,因为这些服务可以检查多个来源,而他们为此付费获得了特权。

    然后,有人将文本通过本地模型进行重写,标记就会丢失,文本又变得干净了。

同日更多故事

2026-08-14