Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.067 — 2026-09-09
NEWS HN 1087 · 3 信源 约 5 分钟

OpenAI称攻克千禧难题,数学界开战

OpenAI称AI已写出并形式化验证千禧难题证明,但数学结论、成果归属和科研数据边界同时遭到质疑。

IMAGE — WSJ Technology

想象一杯咖啡被快速搅动:液体会不会在某个瞬间形成数学上无法继续描述的“无限尖峰”?描述这类流动的是纳维–斯托克斯方程。数学家一直不知道,在三维情况下,它的光滑解是否始终存在,还是会在有限时间出现奇点。如今,OpenAI称一个尚未发布的下一代模型给出了完整证明,还公布了文字说明和Lean形式化证明。如果结论成立,这将是历史性突破。但现在更准确的说法仍是:OpenAI宣布解题,数学界刚刚开始验题。

机器检查过,为什么还不能宣布结案?

纳维–斯托克斯问题是Clay Mathematics Institute在2000年列出的七个Millennium Prize problems之一。每道题的获认可解答都有100万美元奖金。

OpenAI公开表示,这份解答由AI生成,并附有Lean证明。Lean是一种编程语言兼交互式定理证明器。研究者把定义、前提和推理步骤写成机器可读的严格表达,Lean逐步检查结论能否从公理和此前已经证明的命题推出。

这相当于给证明配了一位极其较真的校对员:它不会放过未被规则允许的逻辑跳步。但校对员只能检查交给它的那份文本。外部专家仍要确认,形式化命题是否准确对应Clay提出的原问题,使用的定义和假设是否合适,以及文字论证与Lean代码之间有没有错位。因此,“Lean通过”是很强的证据,却不等于数学共同体已经接受证明。

供稿没有披露证明的关键构造、主要引理或完整推理路线,我们目前无法在本文中解释它究竟靠哪一步跨过了长期障碍。能确认的是,OpenAI发布了解答并声称完成了中心问题;不能确认的是,这个主张已经通过独立专家审查。

一周、3000亿token,以及一场抢跑争议

据TechCrunch报道,OpenAI称这一轮研究由未发布的下一代模型完成。工作从2026年9月1日开始,持续约一周,共生成3000亿个output tokens——也就是模型输出文本时计量用的基本单位。若按当时Astra公开费率折算,这些输出价值约2250万美元。这不是OpenAI披露的实际支出,也不宜与《华尔街日报》所说的“花费数百万美元”直接视为同一口径。

争议来自另一支团队。纽约大学数学教授Tristan Buckmaster与Anthropic研究员Levent Alpöge借助Codex和Claude完成了三项证明,其中包括朝纳维–斯托克斯问题迈进的初步结果,但没有完成中心问题的完整证明。Buckmaster称,两人在公开成果前得知,自己的研究进展已经被传给OpenAI;OpenAI随后沿相关方向投入团队和大量算力,率先做出了形式化证明。

这项指控目前主要来自Buckmaster一方,不能据此认定OpenAI窃取了成果。OpenAI承认本轮工作受到“两项千禧难题可能已被解决”的传闻启发,也确认双方有过沟通,但否认研究人员或AI代理查看过两人的提示和证明。OpenAI还表示,双方公开成果的路线和具体结果并不相同。

据WIRED和Axios报道,双方对署名交涉也各执一词。Buckmaster称,OpenAI曾提出让他参与发布,却不让Alpöge署名;OpenAI研究负责人Sébastien Bubeck否认公司提出过删除Alpöge名字。这部分同样缺少足以定案的独立证据。

真正的新问题,不只是一道方程

这场争论之所以值得关注,不只是因为奖金或“AI首次攻克千禧难题”的标题。它把一种新的科研关系摆到了台面上:数学家用模型协助寻找证明,而提供模型的公司也可能亲自参加同一场竞赛。

Buckmaster团队大量使用Codex,因此担心未发表的工作可能通过产品数据进入模型改进流程。OpenAI否认有人为了本题访问他们的具体用户数据,但承认无法完全排除由产品使用产生的去标识化数据曾帮助改进模型。这里没有证据证明模型复现了两人的工作;问题在于,现有公开信息也不足以彻底排除间接影响。

过去,研究者通常担心同行提前看到草稿。现在还要问:交给AI助手的提示、失败尝试和半成品证明,究竟是不是保密的研究记录?如果工具供应商后来成为竞争者,如何追踪思想来源,又怎样分配信用?这道制度题可能比判断一次抢跑更长久。

局限与未知

  • 证明尚未经过公开的长期同行审查。重大数学结果需要领域专家反复检查、讨论和正式发表,媒体报道与发布方声明都不能替代这一过程。
  • 据Clay Mathematics Institute规则,候选解答须先在合资格刊物发表,经过至少两年,并获得全球数学界普遍接受,研究所才会考虑授奖。现阶段更像发令枪,而不是颁奖礼。
  • 关于未公开思路是否影响OpenAI、双方路线究竟有多接近,以及署名交涉的完整经过,目前只有相互冲突的陈述。最关键的数学判断和责任判断,都仍需更多材料。

所以,眼下最值得记录的不是“AI已经拿下千禧难题”,而是三件事同时发生:AI给出了一份可供核查的重大证明主张,形式化工具把审查推进到前所未有的细度,而科研数据、算力优势与成果归属的旧规则开始承受压力。证明是否成立,要等数学界逐页检查;这场争议提出的问题,已经成立。


供稿材料 SOURCES — 3

← 返回 2026-09-09 · 科技板块