有据可查的 AI 新闻、模型与产品English
新闻重要 研究2026年9月8日

OpenAI 公布千禧年数学难题证明,引发优先权争议

OpenAI 公布了一份由未发布模型找到的证明,针对纳维-斯托克斯方程存在性与光滑性问题(千禧年七大数学难题之一)的一个版本。同一天与 Anthropic 数学家 Levent Alpöge 一起发布相关证明的纽约大学数学家 Tristan Buckmaster 表示,OpenAI 是在得知他们的研究后才开始的;OpenAI 则称在对方公开之前并未看到其工作。

卫星俯拍的云层中,排列着几个黑色的螺旋状涡旋
智利外海云层中形成的「卡门涡街」,摄于 1999 年 9 月。纳维-斯托克斯方程就是描述空气、水这类流体如何流动的方程。资料照片(经裁切)。 照片:Robert Cahalan,NASA/GSFC / Wikimedia Commons,公有领域

发生了什么

9 月 8 日(周二)上午,OpenAI 的数学家宣布,一个尚未对外发布的先进模型,在他们的指挥下以约 1 万个自主 AI 智能体协作,找到了三维纳维-斯托克斯方程的一个「奇点」,从而解决了克雷数学研究所 2000 年提出的千禧年大奖难题之一(据《Quanta》杂志报道)。据《卫报》报道,OpenAI 说这个内部系统比它当时最新的 GPT-6 Astra 更强,并表示不打算领取 100 万美元奖金。

就在大约 12 小时前,也就是 9 月 7 日临近午夜,纽约大学教授 Tristan Buckmaster 发布声明,宣布他与 Anthropic 的数学家 Levent Alpöge 借助多种 AI 模型得到了三项相关结果。声明的后半部分,讲述了他与 OpenAI 之间的一段冲突。

背景:这是一道什么题

纳维-斯托克斯方程用牛顿第二定律描述流体,从洋流到气流都用得上,19 世纪中叶就已写出。工程师天天用电脑求它的近似解,但数学上一个基本问题一直没有答案:它的解会不会在某个时刻「爆破」(blow-up),也就是流体中某个无限小的地方速度变得无穷大?

伪彩色图像中,一股湍流射流从左向右扩散,颜色从红到蓝
水下湍流射流的伪彩色图像(激光诱导荧光技术拍摄)。湍流至今仍是物理学中最重要的未解问题之一。资料照片。 图片:C. Fukushima、J. Westerweel,代尔夫特理工大学 / Wikimedia Commons,CC BY 3.0

据《Quanta》报道,这次两组人用的思路都来自马德里的两位数学家 Diego Córdoba 和 Luis Martínez-Zoroa。他们多年来专门研究「用外力触发爆破」:到 2023 年,两人已证明欧拉方程(不考虑黏性的流体方程)在一个「不规整」的外力下会爆破。剩下的难点,是让外力也足够「光滑」,满足千禧年题目的要求。为克雷研究所写下题目的 Fefferman 对《Quanta》说,他对问题被解决感到「兴奋」,而这个故事真正的英雄是 Córdoba 和 Martínez-Zoroa。

OpenAI 是怎么做的

据 OpenAI 的公告(经《卫报》《Quanta》、TechCrunch 及维基百科转述),OpenAI 的模型做了这些事:

同时工作的 AI 智能体
约 1 万个
找到证明用时
88 小时
再用 Lean 形式化验证
约 17 小时
整周消耗的输出 token
约 3000 亿

来源:《Quanta》《卫报》、TechCrunch 对 OpenAI 公告的报道,2026-09-08

  • 智能体先评估了全部尚未解决的千禧年难题,之后才集中到纳维-斯托克斯问题上(据维基百科对 OpenAI 公告的概述);
  • 另有近 100 个智能体用约 50 小时,得到了欧拉方程的相关结果(OpenAI 新闻稿,《Quanta》援引);
  • 智能体之间一共发送了近 500 万条消息;
  • 成本说法不一:OpenAI 研究员 Sébastien Bubeck 估计计算成本为「几百万美元」(《Quanta》);《The Verge》称 OpenAI 说用了「数千万美元」的算力;TechCrunch 按 GPT-6 Astra 的公开价格折算,整周的 3000 亿输出 token 相当于 2250 万美元。

争议经过

两方对部分细节说法激烈对立,但据《The Verge》报道,双方大体同意事件的基本顺序:

从传闻到两份公告
  1. 18 月 22 日Buckmaster 与 Alpöge 的欧拉方程爆破结果通过 Lean 验证。
  2. 29 月 1 日OpenAI 称因听到传闻,开始攻千禧年难题。
  3. 39 月 3—6 日Buckmaster 联系 OpenAI;6 日通话中得知其模型已有证明。
  4. 49 月 7—8 日Buckmaster 发布声明,约 12 小时后 OpenAI 发布证明。
  5. 59 月 10 日OpenAI 称经调查,Codex 提示词未影响其系统。

来源:Buckmaster 声明;TechCrunch、《Quanta》、《The Verge》、维基百科

Buckmaster 的说法

Buckmaster 在声明中写道,他们的合作「纯属个人」,与双方雇主无关;研究中用了 Anthropic 的 Claude 和 OpenAI 的 Codex(主要是 GPT-5.6 Sol,后来用 GPT-6 Astra 写稿和检查论证)。他们把整个项目的草稿都放在 Codex 里。

他说,9 月 6 日的通话中,对方先给他看了一段提示词,说内部模型「只是被给了题目」;Alpöge 也被 Bubeck 告知「几乎没有人工输入」。但随着通话进行,「逐渐发现有一整个团队在做这道题」,「用了疯狂多的算力」,「最终双方同意,(第一条提示词)是在过去几天才发出的,那时我们的工作信息已经传到 OpenAI」。

他认为,从「光滑外力」入手是 Córdoba 和 Martínez-Zoroa 开辟、他和 Alpöge 悄悄选定的路线,「据我所知几乎没有别人在走」,「这不是给模型一个题目、几天之内就会想到的方向」。

他说 OpenAI 提出两个方案:一是他们先发欧拉结果、OpenAI 第二天发纳维-斯托克斯结果;二是由他一人执笔一篇论文介绍 OpenAI 的结果。他称 Bubeck 两次表示希望把 Alpöge 从作者中去掉,原因是 Alpöge 在 Anthropic 工作。他拒绝了两个方案,并说如果 OpenAI 照此发布,他会公开经过。他称对方回答:「你为什么要毁掉自己的职业生涯?」后来又说:「如果你不想让我客气,那我也不必客气。」

他问过 OpenAI 的模型是否用他的 Codex 对话训练过,称没有得到答复。但他也强调:「我没有看过 OpenAI 的证明……不知道我们的数据是否被使用。我没有指控任何人。」

OpenAI 的说法

  • 时间线:OpenAI 的公告说,这轮研究始于 9 月 1 日,起因是听到「两道千禧年难题已被解决」的传闻,并承认与 Buckmaster、Alpöge 有过沟通(TechCrunch)。据维基百科,Bubeck 当天还写道,OpenAI 开始做纳维-斯托克斯问题,部分是因为 Alpöge 发的一些含糊推文,他曾试图与对方协调发布「同时得到的发现」。
  • 数据问题:公告写道:「我们(研究人员和智能体)在他们公开之前,没有通过任何方式看到他们的工作,尤其是没有为解这道题访问任何特定用户数据。」同时承认:「虽然可能性不大,但我们不能排除,他们使用我们产品产生的去标识化数据帮助改进了我们的模型。不过,我们的证明有很大不同,在欧拉方程上证明的结论本身也不一样(有外力与无外力)。」9 月 10 日,OpenAI 又表示经调查确认,Buckmaster 此前两个月的 Codex 提示词「不可能以任何方式影响该系统,包括通过训练」。
  • 通话内容:据《The Verge》援引《纽约时报》,Bubeck 不认同 Buckmaster 对通话的描述。他承认曾提出用 OpenAI 的资源帮 Buckmaster 完成证明,或由他来执笔公司的论文,并说 OpenAI 和其他数学家也有过类似安排。他也坦言 Alpöge 的身份是个问题:「从我们的角度,怎么能让一名 Anthropic 员工参与 OpenAI 的内部项目?」据《卫报》,Bubeck 在发布会上否认公司使用了两人的工作。
  • 优先权:据《Quanta》,OpenAI 把三维欧拉方程结果的优先权让给 Buckmaster 和 Alpöge,纳维-斯托克斯结果则归于自己。

Buckmaster 对 OpenAI 9 月 10 日的说法回应称:「鉴于他们到目前为止的行为,对这类说法应当高度怀疑。」通话的具体内容只有双方各自的叙述,外界无法核实。

数学界怎么看

  • 结果本身:芝加哥大学数学家 Luis Silvestre 对《科学美国人》说:「克雷的题目解决了,但纳维-斯托克斯方程的主要问题没有解决。」9 月 17 日,Peter Constantin、Mihaela Ignatova 和 Vlad Vicol 发布预印本论文,称 OpenAI 的方法无法推广到没有外力的情形。数学家 Gonzalo Cao-Labora 说,如果「只有加外力才会爆破」被证实,人们可能会说「当初不该把外力写进题目」。
  • 克雷研究所:9 月 11 日发表声明,称纳维-斯托克斯问题「显然已经被解决」,但评奖过程「刻意不急」。按规则,结果发表满两年、并在全球数学界获得普遍接受后才会评奖。
  • 对研究生态的担忧:《The Verge》采访的十几位数学家中,许多人担心 AI 公司会让研究者对未完成的工作更加保密。菲尔兹奖得主丘成桐担心,与资源远超学术界的 AI 公司竞争,会让博士生和年轻学者更不敢挑战难题。9 月 11 日,28 位菲尔兹奖得主发表公开信批评 AI 公司的做法(见《28 位菲尔兹奖得主就数学问题警告 AI 公司》)。

需要注意的地方

  • 证明尚未经过同行独立审查。 据维基百科,截至 9 月 18 日,OpenAI 的证明尚未被独立验证。Lean 验证提高了可信度,但仍需人确认命题表述无误。
  • 它解决的是「有外力」的版本。 按克雷研究所的原始表述,这算数;但多位专家认为,大家真正想知道的「无外力」问题仍然开放。
  • 争议的关键事实无法核实。 私下通话的内容只有当事人各自的说法;OpenAI 的模型和完整过程没有公开。
  • 成本数字是估算。 几百万、数千万、2250 万美元,来自不同人的不同算法。

对普通人意味着什么

一年多前,AI 还在为国际奥数金牌线努力(见《AI 在国际数学奥林匹克达到金牌水平》);现在,在投入巨量算力的情况下,AI 已能在前沿数学难题上做出数学家认可的突破。但这次用的是未公开的内部模型,普通用户用不到同样的系统。

这场争议也提醒了一件很实际的事:你在 AI 工具里输入的内容可能被用来训练模型。据 TechCrunch,OpenAI 保留用 Codex 对话训练模型的权利,但用户可以选择退出。如果你用 AI 处理未公开的研究、代码或商业资料,最好先查看并设置好数据使用选项。

来源