Claude 如何标记 AI 生成内容

How Claude marks AI-generated content

Claude 如何标记 AI 生成内容

Anthropic 在支持文档中详细解释了 Claude 对 AI 生成内容的标记机制。这一举措旨在提升透明度,帮助用户和平台识别由 AI 创作的内容。文章涵盖了标记的具体方式、适用场景以及背后的技术逻辑,强调了在 AI 普及时代保持内容真实性和可追溯性的重要性。对于开发者、内容创作者以及普通用户而言,理解这一机制有助于更好地利用 Claude 的功能,同时遵守相关的使用规范。

Claude 通过添加特定的元数据来标记由其生成的内容,以确保内容的可追溯性和透明度。
  1. Dilettante_

    > 当受支持的 Claude 模型生成文本时,它会直接将一种难以察觉的水印编织进文本本身。你看不见它,它也不会改变 Claude 回复的含义、质量或可读性。

    我很想深入了解这背后的工作原理。

    我与 Claude 的许多交互都会返回相当精确的文本。如果我让它编辑一个项目,并在多个地方重构某个特定函数,而我非常清楚我想要发生什么,那么如果这些重构的文本中嵌入了某种奇怪的图案作为水印,那绝对不行。

    我想这可能已经被以下说明涵盖了:

    > 如果例如:[...] 段落非常短,留下的文本不足以产生可靠的信号,那么 Claude 生成的内容可能不会带有可检测的标记;

  2. simonw

    我听说这种水印处理过程的工作原理是:在每个位置,将统计采样偏向于可能下一个 token 集合的某个分区(红色集合和绿色集合)。每次可能只是轻微的推动,但在一系列 token 中,偶然重复这种偏差的概率会越来越低。

    这种偏差在每个位置都不同,并遵循一个定义好的随机数生成器(RNG),以某种可预测的方式初始化种子。

    这可以是公开算法,也可以不是。如果不是公开的,那么可以提供一个 API 来判断文本是否带有水印。

    它如何应用于代码——也许是对符号名称等进行微妙的调整,我只是在推测(我最近只是偶然读到过这个)。

  3. mchusma

    这里一个有趣的因素是竞争。

    如果 Claude 是唯一一个模型家族,他们可以推出这样的改动,而那些想作弊(或出于其他原因不喜欢水印)的用户只能忍气吞声。

    但在一个拥有许多不同竞争模型的世界里,因为这个问题而失去客户给其他提供商的风险要真实得多。

    也许他们已经看过数据,发现那些明显使用 Claude 来作弊(比如应付示例等)的人所占比例微乎其微,因此失去他们给其他提供商并不是问题?

  4. benrow

    我一直有个直觉,即(除了这些工具之外),Anthropic 实际上一直在强化 Claude 独特的写作风格,因为这使得文本更明显地看起来是 AI 生成的,从而更不容易被滥用。

    这不一定等同于马尔可夫风格的指纹,但它可能是一个相关的因素。

  5. mhjkl

    所以,Claude 生成的代码,以前是使用最适合(概率最高)的 token 来完成工作,现在却要在随机位置变得更差,以迎合欧盟的一个自愿性建议。太棒了。

同日更多故事

2026-08-11