Codeberg 禁止 LLM 训练与 vibe-coded 项目
Protecting our FLOSS commons from LLMs
Codeberg e. V. 成员投票通过两项决议:绝不使用用户数据训练 LLM,并修改条款禁止'vibe-coded'项目。我们认为 LLM 不仅消耗巨大硬件资源、推高存储成本,还通过无意义爬虫拖累服务器性能。更严重的是,它让单人开发者消耗社区资源,制造大量无人维护的'幽灵项目',同时侵蚀 FLOSS 生态中人与人之间的信任。当代码不再源于真实协作,而是统计机器的产物,开源精神正面临前所未有的挑战。
使用 LLM 处理代码能带来肾上腺素飙升的快感,让你仿佛拥有庞大团队,但实际上你往往孤身一人,只是在操作一台将能源转化为代码的统计机器。
HN 评论区
144- tptacek
这很合理。Codeberg 上目前托管的最大项目是什么?Zig 吗?Zig 本身也对 LLM 代理持公开敌对态度。这为网站确立了一个清晰的定位:一个反 LLM 项目的家园。
我基本上不同意他们这里的逻辑,但这正是重点:并非每个网站都要迎合所有人。显然,有很多软件开发者强烈赞同他们所采取的立场。他们需要一个社区中心,而现在他们有了。
- croemer
由于博客文章本身并没有包含服务条款(TOS)的变更内容,只在文末链接了它,所以我把它贴在这里:
> 7. 您不得分享主要由“生成式 AI”工具(包括 Claude、OpenAI Codex 等服务)编写的代码构成的项目。此类项目的版权状态不明确(参见要求 § 2 (1) 1 和 § 2 (1) 3),此外也缺乏足够的保障措施来确保其中不包含有害代码(参见 § 2 (1) 5)。
https://codeberg.org/Codeberg/org/commit/96fac426a32d1ba91ff...
- TheChaplain
我其实看不出这个决定(或者关于加密货币的那个决定)有什么问题,这是由 Codeberg 的活跃成员投票决定的,只是一个民主的结果。
- arjie
看起来没问题。Git 托管服务并不是那种很难自行维护的软件,而且大多数东西 GitHub 上都有。
我能理解为什么。对托管方来说,成本完全在于代码量,而现在生成代码量变得很便宜。如果没有一些限制措施,他们将会收到大量 AI 生成的代码。光是这一点就让人无法接受了。
这也是文化层面的事。这是为了那部分特定开发者群体。这没问题。社区都有自己的(往往非常具体)规则。HN certainly 也有,而我们都在这里。
- arkwin
讨厌 LLM 的开发者们:你们没有按照我脑海中凭空捏造的关于软件该如何制作的精确规则来开发软件,所以我要筑起高墙,讨厌你们以及你们写的代码。
这就是所谓的“保护社区免受 LLM 侵害”听起来的样子。
事实上,用 LLM 创建了大量完全合格的软件。目前并没有一种好的方法来检测软件创建过程中是否使用了 LLM。这就像说考试“不许作弊”,然后对任何看起来可疑的地方都进行指责?解释代码的注释太多?那是 AI。if 语句太多?那是 AI。我觉得看起来太像 AI 了?肯定是 AI。
我不知道,这对我来说似乎是一场必输的仗。我很高兴大家对此进行了投票。你可以反对 AI 是因为它“煮沸了海洋”(指过度复杂化),但很多人正在使用开源的离线模型来写代码。
至于版权论调,我怀疑这在普通人的生活中根本不会成为问题。事实上,在法庭上这也从未被很好地论证过。
最后,“主要由生成式 AI 工具编写的代码构成”到底是什么意思?好吧,我们来推演一下。Linux 内核?可能没有太多 AI 生成的代码。5 到 10 年后的 Linux 内核?可能大部分代码都是由 AI 编写的。或者按照这个速度,任何软件随时间推移都会如此。
这是我的两分钱观点。
- evantbyrne
从他们最近的公告来看,Codeberg 似乎运作得像一个碰巧拥有 Git 界面的俱乐部。如果你愿意入戏,这或许有点意思,但我实在想不通为什么要真的在一个拥有这种治理结构的组织里托管任何东西。
- somnium_sn
互联网上有某些角落以某种特定方式运行,这本身没问题。
然而我的问题是,这是在改变规则。Codeberg 最初是作为大公司 GitHub 的 FLOSS 替代品出现的。现在它变得更狭隘了,是 GitHub 的替代品,但仅限于那些不想使用 AI 的人。下一步是什么?这就是问题所在:你要么是一个在法律允许范围内保持中立(agnostic)的平台,要么你就是试图成为一个特定的社区。我不清楚 Codeberg 今天想成为的那个特定社区,是否就是它一年后想成为的样子,因为它显然正在发生变化。
我无法依赖一个变化如此迅速的服务提供商。
- AussieWog93
我运营着一个开源项目,也为其他项目做贡献。在过去的 6 个月里,我利用硬垃圾/电子垃圾搭建了两个家庭实验室(一个在公司,一个在家),运行着大量开源软件。
我不理解这种反 AI 的情绪。
从维护者的角度来看,它基本上消除了以前存在的整个类别的令人沮丧和繁琐的工作——特别是在打包和 CI/CD 方面。
我不再需要在那个漫长的夜晚反复折腾,试图让构建过程推进一点点,直到 GitHub Actions 最终产出一个正确的构建结果。我现在只需登录 `gh`,把规范给 Claude(“请在合理的地方尽量静态链接,支持这些平台 xyz,回退到版本 abc