us-vs-them:谁写了这行代码?
Human vs. AI – Diff-based line-level provenance for text under agentic editing

在 AI 代理辅助编程日益普及的今天,区分哪些代码由人类亲手编写、哪些由 AI 生成变得至关重要。GitHub 项目 us-vs-them 提供了一种基于版本历史的行级溯源方案,无需在文件中添加任何标记,即可精准识别代码的归属。它利用 diff 技术将文本划分为人类创作的'岛屿'和机器生成的'海洋',帮助开发者在 AI 自动编辑中保留核心逻辑的掌控权。无论是保护关键代码段不被 AI 随意覆盖,还是确保 README.md 等文档中人类修改的部分得到尊重,这个工具都能提供清晰的归属判定。对于希望在人机协作中保持主导权的开发者来说,us-vs-them 是一个不可或缺的工具。
人类编写或编辑的文本应被视为近乎神圣:代理应当保持谨慎,除非有非常充分的理由才去触碰它。
HN 评论区
15- spuz
> Git 仓库本身就已经是版本历史了,每个版本都带有来源标记——按顺序记录文件的每一次修订,以及做出该修改的作者。
也许我错过了现在人们使用 AI 的方式,但当我在本地使用 AI 代理时,所有的 git 提交都会附带我的作者身份。
- hamandcheese
我很好奇大家为什么在乎这种追踪?我几乎不再使用编辑器了,而且我不是唯一一个。唯一重要的是谁在提交上签字确认。
> 人类撰写或编辑的文本应被视为近乎神圣:AI 代理在触碰这些内容时应保持谨慎,并有非常充分的理由。
我不太同意(尤其是针对代码,而非散文)。如果代码因非显而易见的原因而难以修改,应该加上注释说明。字节是如何生成的并不重要。
> 另一个用例:README.md 最初是生成的,但你重写了开头几段。代理应该可以自由地重写或追加下方内容,但在修改开头部分时真的应该三思。
这一点我理解。
- alansaber
很酷,我们也在做同样的事情,不过我们还会标注哪些行是“由 AI 生成但经人工修改过”(即只要人类对内容进行了哪怕一个字符的改动,就算作人工修改)。