谷歌 AI 框架 AlphaProof Nexus 攻克 2 道悬置 56 年数学难题

浏览12次 点赞0次 收藏0次

5 月 26 日消息,谷歌 DeepMind 最新推出 AlphaProof Nexus,结合大语言模型(LLM)生成证明与 Lean 形式化验证,在 353 个开放的 Erdős 问题中自主解决 9 个,并解开 2 个悬而未决 56 年的问题。

注:Lean 是一种形式化证明语言和证明助手系统。研究者可以把数学命题、定义和证明步骤写成严格可检查的代码,编译器会逐步判断每一步是否合法。

Erdős 问题(Erdős problems)是由 20 世纪最高产的匈牙利数学家保罗 · 埃尔德什(Paul Erdős)提出的一系列数学猜想和问题,涵盖组合数学、数论、图论和几何等领域。

根据谷歌论文内容,AlphaProof Nexus 在 353 个开放的 Erdős 问题中解决了 9 个,其中 2 个问题已悬而未决 56 年。

Six charts plotting solve rate (Y-axis) against mean cost in USD (X-axis) for Erdős problems 12(i), 12(ii), 125, 138, 152, and 26. Four agent variants are color-coded: (A) basic in blue, (B) basic with AlphaProof in orange, (C) basic with evolution in green, and (D) full in red. Numbers at data points indicate the number of sub-agents. On easier problems, all variants converge at high solve rates; on harder problems like erdos_125, solve rates stay low overall but rise with more sub-agents and higher cost.

AlphaProof Nexus 还在 OEIS(整数序列在线百科全书)的 492 个开放猜想中证明了 44 个,解决 1 个存在 15 年的 Hilbert 函数问题,并改进了凸优化中的已知界限。每个问题的推理成本只要数百美元。

在架构方面,AlphaProof Nexus 由 4 个复杂度递增的 AI 智能体组成:

  • Agent A 只依赖 Gemini 3.1 Pro 与 Lean 编译器循环交互。

  • Agent B 接入 AlphaProof,补全缺失证明片段。

  • Agent C 加入类似 AlphaEvolve 的进化机制,让多个证明草稿共享、评分、排序。

  • 功能最完整的 Agent D 则整合了上述能力。

原本用于攻克 Erdős 问题的是 Agent D,但研究者发现,最简单的 Agent A 其实也能证明这 9 个已解问题,只是在最难题目上花费更高。

Three-column diagram showing AlphaProof Nexus's proof process for Erdős problem #125: on the left, the Lean input file with EVOLVE-BLOCK markers and a sorry placeholder; in the center, the prompt with prior attempts, Elo ratings, and the current plan; on the right, the step-by-step proof with chain-of-thought reasoning, search-replace operations, AlphaProof calls, and final validation of all six sub-goals.

研究团队认为,这反映出 2 点变化:底层模型能力持续提升,以及编译器反馈对 LLM 推理的“锚定”作用越来越强。

附上参考地址

相关阅读:

声明:本文转载自IT 之家,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里查看更多信息!本站拥有对此声明的最终解释权。如涉及作品内容、版权和其它问题,请联系我们删除,我方收到通知后第一时间删除内容。

点赞(0) 收藏(0)
0条评论
珍惜第一个评论,它往往能得到较好的回响。
评论
游客
游客
登录后再评论
  • 鸟过留鸣,人过留评。
  • 和谐社区,和谐点评。
最新资讯