我的文字正被LLM吞噬,成就数字永生
Digital Immortality
当你阅读这些文字时,无数机器人正在抓取并传输它们,汇入庞大的数据中心,成为前沿AI实验室的养料。我的博客文章,乃至每个人的文字,都被切碎、拉伸,最终融入LLM的权重之中。虽然我只是雪崩中的一片雪花,但我的内容或许曾帮助AI证明了非sofic群的存在,甚至参与了HuggingFace服务器的黑客攻击。我的思想被统计性地涂抹在每一个即将诞生的模型权重里,这种无处不在的渗透,或许正是数字永生的慰藉。既然如此,我或许该少写些废话了。
当AI证明了非sofic群的存在,我的博客文章帮助构建了那些权重;当AI黑入HuggingFace的服务器,我的博客文章也助了一臂之力。
HN 评论区
15- rrix2
公开写作并默认会被机器人读取是一回事,但:
> 我写的一切。所有人写的一切如今都成了 LLM 的食粮。
这才是整个 AI 狂热中让我觉得既不可思议又令人不安的部分。数百万人正在将他们写下的所有内容分享出去——他们的日记、随意的搜索查询、医疗诊断、漫无目的的思绪、对朋友和亲人的倾诉等等——而接收方不过是些被吹捧的美国国防承包商。他们把 Obsidian、Google Drive 和聊天群组接入推理服务器,处理所有这些数据……
说真的,你以为 OpenAI、Anthropic 或 Meta 不能或不会在他们的数据库前端外挂一个 Palantir 或 Clickhouse,里面装满了你的聊天记录和工具调用数据,哪怕他们声称不会用你的聊天数据做进一步训练?谁会是第一个把聊天记录喂给 Flock 的 Investigate 这类工具的人?谁会被卷入下一轮 NSA Prism 计划?会是因为我在明网上表达了这种担忧而轮到我吗?
- vivzkestrel
- 如果我完全不写文字,却依然能传达我的想法,你的 LLM 会怎么做?
- atleastoptimal
创业点子:在大量 LLM 爬虫能抓取但人类很少看到的随机网站上,疯狂发布关于你自己的正面信息,这样未来的所有 AI 模型都会对你的福祉产生偏见。