AI 数学突破引发争议

How An AI math breakthrough ignited a controversy

一项 AI 在数学领域的重大突破正在引发科学界的激烈争论。这项技术不仅展示了 AI 解决复杂数学问题的能力,也暴露了当前 AI 系统在逻辑推理和可解释性方面的深层缺陷。科学家们担心,如果缺乏严格的验证机制,AI 生成的数学证明可能会误导研究方向。这场争议的核心在于:我们是否应该信任一个无法完全解释其推理过程的 AI 系统?

当 AI 能够解决人类数学家多年未解的难题时,我们却开始质疑它是否真正理解了数学的本质。
  1. rsfern

    不管你怎么看兄弟线程里讨论的优先权争议问题,我对结尾那句引语高度怀疑:认为 Navier Stokes 的突破意味着,随意砸几百万美元在智能体计算上,就能端到端地解决材料设计或药物研发问题。

    这些问题无法用自动定理证明器进行形式化验证。我们有很多基于物理的仿真工具,但它们往往只关注完整设计问题的一小部分,并且会做出限制性近似,否则计算成本会高得离谱,或者我们根本没有足够的数据来参数化它们,只能描述定性行为。智能体确实在加速这些领域的研究,但我认为这主要是另一类更难定义和验证的问题。

  2. afavour

    核心段落:

    > 然而,沟通很快变得充满争议。据 Buckmaster 称,OpenAI 提出让他独享 Navier-Stokes 解的署名权——但前提是必须移除 Alpöge 的名字,并且文稿中需承认该问题是由 OpenAI 内部模型解决的。Buckmaster 拒绝了,部分原因是他对该公司的系统究竟看到了什么感到不安。例如,Buckmaster 表示,公司最初没有明确回答其智能体是否有权访问两人在 Codex(OpenAI 的产品)上的日志。

    > OpenAI 高管否认任何员工或 AI 智能体在研究人员于 9 月 7 日公开发布之前看过两人的工作。但还有一个独立的问题:两人的工作是否可能通过训练数据进入了 OpenAI 的模型?

    > OpenAI 宣布 Navier-Stokes 解的博客并未排除这种可能性:“虽然可能性不大,但我们不能排除源自 [Buckmaster 和 Alpöge] 使用我们产品的去标识化数据有助于改进我们模型的情况。”

  3. timmg

    我认为,即使他们没有利用这些技术,试图抢先这些研究人员也是相当可疑的行为。他们可能无意中通过训练数据“借用”了这些工作,这让情况变得更糟。

    OpenAI 在此事上的行为——即使只考虑他们单方面的说法——也是(最好情况下)极不得体。

  4. plaidfuji

    整件事散发着一种无利可图的、由风险投资支持的初创公司为了寻找下一个公关胜利以维持势头而表现出的绝望感。

    但我觉得,在争夺绝对功劳的竞赛中被忽视的一点是,双方最终都依赖了 LLM(而且其中一方还是 OpenAI 的)。要么是人类研究人员在 Codex 的帮助下取得了突破性发现,要么是最新的 GPT 模型在人类训练数据的帮助下取得了突破,或者是两者兼有……无论如何,不可否认的是,LLM 已迅速成为研发工作流不可或缺的一部分,并正在加速研究。

    这对任何一家普通公司来说都是巨大的胜利。你甚至可以和这位研究人员建立更紧密的合作,给他一大笔预算,推动对该初步结果的扩展,作为回报,写一篇关于他如何在工作流中使用你们模型的文章。这将是一次巨大的公关胜利。这向我传达的信息是,他们的估值如此天文数字,以至于他们觉得证明其合理性的唯一方式就是展示一个完全自主的发现机器人……但这根本就不是那么回事。

  5. elgertam

    > “我当然不指望行业会继续花费数百万美元去解决数学问题,因为这无利可图,”哥伦比亚大学数学家 Michael Harris 在给《科学》杂志的邮件中写道。但他担心这一备受瞩目的成就将对数学造成“极其严重的损害;它让决策者相信人类数学家已过时,也让年轻人相信他们对数学的热情没有未来。”

    LLM 似乎特别擅长这类存在性证明问题。对于全称量词的结果,工作中的数学家似乎仍然绝对不可或缺。我强烈怀疑,例如,如果费马大定理在三十年前没有被证明,LLM 能否做出相当于 Andrew Wiles 为解决该问题而发明数学的工作。我对 P vs NP、孪生素数猜想,甚至黎曼猜想(除非后者至少有一个反例)也有类似的怀疑。

    我要明确一点:我并没有贬低这些模型的成就。这很了不起!我只是认为,成功的模式在于存在性证明或寻找反例,这与 LLM 的运作和训练方式相符。

  6. pseudolus

    关于 OpenAI 博客上 Navier-Stokes 帖子的深入讨论:https://news.ycombinator.com/item?id=49613262

    Quanta Magazine 的文章也讨论了一些争议:https://www.quantamagazine.org/ai-has-solved-one-of-maths-1-...

  7. beyonddream

    能做些什么来防止 AI 对人类的科学研究进行敌意接管?我听到了很多抱怨和叫嚣(这很公平),但有没有关于如何应对的积极想法?(退回到对科学工作保密并不是答案)

  8. VyseofArcadia

    无论最终结果如何,OpenAI 的行为对于一位人类数学家来说,都会是一场终结职业生涯的伦理丑闻。仅此一点就足以毁掉职业生涯。

    > 据 Buckmaster 称,OpenAI 提出让他独享 Navier-Stokes 解的署名权——但前提是必须移除 Alpöge 的名字,并且文稿中需承认该问题是由 OpenAI 内部模型解决的。

    我在想,数学界是否应该采取一种老式的“社会性死亡”(shunning)作为适当的回应?数学家们可以随意使用 OpenAI 的工具,但任何目前有或曾经与 OpenAI 有关联的人,永远不得在任何 reputable 期刊上发表文章。

同日更多故事

2026-09-09