法律人如何看懂AI安全研究
What I learnt co-leading an AI Safety bootcamp for legal and governance practit

我联合Elsa Donnat为法律与治理从业者设计了首期欧洲前沿AI与法律研讨会。来自12个司法管辖区的19位资深专业人士,在East Sussex的五天封闭营中,深入探讨了从模型训练、评估到Agent与防护机制的全流程。我们惊讶地发现,这些掌握合同条款、风险评估和部署审批大权的非技术专家,早已在阅读AI Control论文和Golden Gate Claude等研究,却苦于缺乏解读技术细节的能力。他们渴望理解模型推理的真实逻辑,厘清安全承诺的边界。这次经历让我意识到,AI安全不仅是实验室的事,市场激励机制的构建更依赖这些身处企业一线的专业人士。只有当法律与治理团队具备技术素养,才能真正推动安全成为商业决策的核心。
许多法律与治理从业者最终面临的法律问题,实际上需要技术层面的解决方案。
HN 评论区
20- brunohaid
基本同意其他那些批评意味浓厚的评论。这确实是一个怪异的封闭亚文化圈,Trashfuture 本周有一篇极好的总结:
“荒诞的假设,权力幻想,以及那种只差一步就能变成愤怒海盗的性生活。[这就像] 一群 12 岁的校园枪击案凶手被汤姆·汉克斯《长大》(Big)里的魔法变成了成年人,然后他们渗透进了那个本该解决世界所有问题并取代现有经济的机构的治理层。
……然后他们什么都不做,也学不到任何东西,只是一味地发帖、发帖、再发帖,而他们既不懂计算机,也不懂他们幻想中的那些安全问题。更糟糕的是,他们强加给我们、向我们兜售的观念是:计算机只能被理解为一种魔法之神,因为对 Eliezer Yudkowsky 来说,它确实就是神。”
- https://www.youtube.com/watch?v=zcPR6rde1GQ 或
- https://www.patreon.com/trashfuture/posts/last-days-of-17089...
- gausswho
> 市场应该选择的不是能力最强的模型,而是那些在安全性方面拥有最强激励措施的合作伙伴,而只有具备这种知识的社区才能传播这一理念。
严格按字面解读,作者声称只有 ML4Good 或同类组织才拥有知识,能够决定我们应该使用哪些模型。我坚决不同意。或者更准确地说,“他们甚至错得离谱”,因为这篇文章连“AI 安全”的皮毛都没沾上。
冒着人身攻击的风险,这不过是一位 Accenture 的顾问为了自己的目的在随意扩大定义。也许有一天他们会定义什么是“好”。
我们以前见过这种浪潮:那些大谈 A 敏捷(Agile)的顾问、兜售微软认证的骗子,以及在我那个年代之前的各种骗子。
这是一篇冗长(可能是 AI 写的?)的文章。我一开始还抱着善意去解读。但到头来,我始终无法摆脱这种感觉:即便在概念人性化方面有些可取之处,这本质上还是那种“自以为是、优于他人”的模糊自我推销,趁机把自己的“骗局”拖车挂在了当日的流行热词上。
- kingcauchy
文章评论区里的这个链接也很有意思 https://www.lesswrong.com/posts/bfwH88cFEm3r7PWfv/what-lawye...