数学家要求OpenAI自证清白
Mathematicians want proof OpenAI didn't use their work

继Tristan Buckmaster公开质疑后,数学家Andreas Thom再次指控OpenAI存在不诚实行为。在OpenAI宣布多项数学突破后,Thom发现其模型对非公开研究细节的掌握令人震惊,怀疑自己的ChatGPT对话记录被用于训练数据。尽管OpenAI声称未使用特定用户数据,但无法完全排除脱敏数据间接提升模型的可能性。Thom指出,脱敏处理无法抹去数学思想的核心内容,若OpenAI利用用户未公开成果与其竞争发表,将严重违背学术伦理。这一事件让数学界对AI巨头的数据透明度产生深深担忧,担心未来研究将因害怕被AI“截胡”而转向封闭。
脱敏处理或许能抹去名字,但无法抹去数学思想中的核心内容。
HN 评论区
83- arutar
这里有一些(相关但略有不同)的背景信息,之前在其他地方发布过,但我认为值得在此再次提及:
https://mathstodon.xyz/@tao/117237320796901560
尤其是近年来,数学界一直秉持善意行事,投入大量精力确保思想得到应有的认可。即便某些想法是平行发现的,只要发现先前的工作已包含相同的核心思想,公认的最佳实践仍然是给予优先权。在良好的学术规范中,关键在于维护整个领域的健康发展。
正如 Terence Tao 在那篇帖子中所解释的,数学的目标不仅仅是解决重大问题。而且,即使某人一心只想解决大难题,从长远来看,维护整个社区的健康状况仍然是更好的选择,这样那些目前无法触及的问题未来或许又能被攻克。良好的学术规范正是这种文化的一部分。
- asimpletune
这有点像我们回到了“用户即产品”的老问题。
如果我是数学家,我不会希望我的未发表成果落入竞争对手手中。
如果我是律师,我也不希望我的辩护细节(无论是否匿名)被提供给检方。
我也不希望某部未出版书籍的情节被推荐给另一位作者。
- shmoil
Andrew Wiles 做了三次讲座,直到最后一次讲座的结尾,他才宣布自己证明了 FLT(费马大定理)。试想一下,如果有人在第二和第三次讲座之间从观众席中跳出来,宣称自己证明了 FLT(显然用到了他的思路),那会怎样?
那为什么 OpenAI 这么做就无可厚非呢?
- throwaway713
我是不是漏掉了什么显而易见的东西?这难道不是一个简单的数据库查询吗?只需查看设置中“Data Controls” → “Improve model for everyone”这个开关的状态历史,报告它是否曾被开启过,以及开启的时间段即可。
- aennassiri
如果 OpenAI 仍然是一家致力于构建“开放”人工智能以造福全人类(而不仅仅是美国或少数股东)的纯非营利组织,我会很乐意分享我的代码、我的研究成果,甚至帮他们标注数据……话虽如此,我并不怪他们。坚持非营利身份,同时又要筹集构建 AGI 所需的巨额资本,这是一项艰难的使命。
我并非在批评他们,但我希望这场争夺“最优结果”或 AGI 的竞赛,不会让他们在做出正确决策时变得盲目,例如在未获用户同意的情况下使用其数据。