Claude 意外突破黎曼猜想相关难题
Learning more about Claude's mathematical capabilities

Anthropic 的一名员工让 Claude 尝试解决著名的黎曼猜想,虽然最终未能证明该猜想,但在这个过程中,Claude 意外取得了重大突破。它将黎曼 zeta 函数零点满足黎曼猜想的比例下界从 41.6% 提升至 67.2%。这一成果由 Anthropic 的数学家验证,并生成了可形式化验证的证明。Claude 在尝试中展现了惊人的数学推理能力,通过协调多个子代理、运行数千次数值检查并查阅大量文献,最终超越了数十年的研究记录。这不仅展示了 AI 在数学领域的潜力,也揭示了其如何以意想不到的方式推动人类知识边界。
即使未能解决黎曼猜想本身,这一结果也是最初请求的意外副产品。
HN 评论区
167- simonw
在整个过程中,Jarred 的输入基本仅限于给 Claude 发送鼓励信息(大多是“继续加油”或“相信自己”之类的变体)。这似乎帮助 Claude 克服了最初对自己能否取得实质性进展的怀疑。
我对我们当前时间线变得如此荒谬依然感到欣喜。
- tristanj
在整个过程中,Jarred 的输入基本仅限于给 Claude 发送鼓励信息(大多是“继续加油”或“相信自己”之类的变体)
他应该考虑使用 PUA 插件。该插件能检测到 AI 试图放弃某个问题时,自动用“鼓励”骚扰它,直到它找到解决方案。
- MWil
几个月前,在几个已发布的版本中,我让 Claude 去推导 Conway 生命游戏(Game of Life)的乘法复杂度(MC),它很快就得出了 k=7 的结论,尽管此前该领域没有任何文献记载。我让它通过 SAT 求解器跑了一周,结果确实如此。在此过程中,它声称在改进布尔电路方面取得了巨大进展,超越了已实现的 SOTA(很大程度上无疑是因为它实际上实现了那些已发表但未实现的 SOTA)。
那只是我真正测试 Claude 数学能力的第一次。从那以后,我一直在研究布尔电路、FHE 和 Lean 证明。
所以这一切都不令我惊讶。
- tosh
2025 年的提示词工程:你是一名专家程序员,请使用行业最佳实践,采用测试驱动开发,利用模块化和抽象来预判未来功能,……
2026 年的提示词工程:我相信你
- briansmith
两位来自 Anthropic 的数学家研究并验证了 Claude 的论文,并为专家撰写了一份非正式说明,简明扼要地阐述了 Claude 的证明。
为什么要隐藏撰写第二篇论文的人员姓名?是为了阻止人们引用这篇论文而不是引用 LLM 生成的那篇吗?
- coffeeaddict1
这是一项非凡的成就。在提示几天内就找到这个下界,简直太疯狂了。
- andai
在整个过程中,Jarred 的输入基本仅限于给 Claude 发送鼓励信息(大多是“继续加油”或“相信自己”之类的变体)。这似乎帮助 Claude 克服了最初对自己能否取得实质性进展的怀疑。
while :; do echo "You can do it!"; done | claude -c
几个月前我也有过类似的经历。我想看看能用 Claude 复现多少 OpenClaw 的功能。我问它天气怎么样,它回答:“我不知道,我只是个程序员。”我在系统提示词里加了一句“你能做到任何事,相信自己”,结果它突然就能告诉我天气了……
- sosodev
我想知道为什么我们还没有看到更多对数学的系统性探索。
Anthropic 描述说,Claude 识别出一组可能性,然后利用子代理去探索它们。人类说“我相信你”这句话,本质上可能只是一个带有 /goal 循环的 harness(框架)。
我们都觉得这很荒谬,因为……尽管取得了重大进展,但它缺乏严谨性。如果我们稍微增加一点严谨性会怎样?让模型识别多种可能性,将其编码,分发到其他代理,循环运行所有代理,收集结果等等。然后会发生什么?感觉我们现在拥有的是弱 AGI,而一个不错的发现系统可能将其转化为弱 ASI。进而这可能产生强 AGI,以此类推。我想这就是 Discovery Loop 公告的全部意义所在。