论文多源确认93°

OpenAI 宣布解决 Navier-Stokes 千禧年难题

OpenAI 正式宣布:其内部模型解决了 Navier-Stokes 千禧年难题。论文和 Lean 形式化证明已公开。 这是 Buckmaster 声明 https://t.co/BwkY0K4CL...

精选理由

OpenAI 用上万个 Agent 解决了流体力学千年难题,还和数学家 Buckmaster 有学术争议。

OpenAI 声称其内部模型生成了三维不可压缩流体在光滑外力作用下发展出奇点的解析证明,对应 Clay 千禧年问题中的 C 和 D 项。该成果由约一万个并发 Agent 协作完成,消耗 1300 亿 token,耗时 88 小时。OpenAI 还声称解决了无外力 Euler 方程的正则性问题,配有 Lean 形式化验证。目前数学界尚未完成独立验证。

原文 · 宝玉

OpenAI 正式宣布:其内部模型解决了 Navier-Stokes 千禧年难题。论文和 Lean 形式化证明已公开。 这是 Buckmaster 声明 https://t.co/BwkY0K4CL...

OpenAI 正式宣布:其内部模型解决了 Navier-Stokes 千禧年难题。论文和 Lean 形式化证明已公开。 这是 Buckmaster 声明 weibo.com/1727858283/Rh9… 发出后数小时内的回应,但 OpenAI 的说法远不止辩解,他们声称拿到了更强的成果。 【OpenAI 称证明了什么】 OpenAI 称,其尚未发布的内部模型(比 GPT-6 Astra 强得多)生成了一个解析证明:三维不可压缩流体在光滑外力作用下,可以在有限时间内从光滑初始状态发展出奇点(即速度趋向无穷大),同时能量保持有限。这对应 Clay 千禧年问题中 Fefferman 表述的 C 和 D 项。 此外,OpenAI 还声称顺带解决了无外力 Euler 方程的正则性问题。注意“无外力”三个字,Buckmaster 和 Alpöge 证明的是带光滑外力的 Euler 爆破,而 OpenAI 声称做到了不加外力。如果成立,这是一个严格更强的结果。 两项成果均配有 Lean 形式化验证,代码已发布在 GitHub 上。 【怎么做到的:上万个 Agent 军团】 OpenAI 描述的方法相当有冲击力。他们使用了一套由内部模型驱动的多 Agent 协作系统。Agent 被分成若干组,组内可以通信,每组尝试不同的进攻方向。处理 Navier-Stokes 的那组涉及约一万个并发 Agent。 整个过程中,Agent 发送了 270 万条消息,消耗约 1300 亿输出 token。Navier-Stokes 的解在首批 Agent 启动约 88 小时后到达。随后 GPT-6 Astra 用 17 小时完成 Lean 形式化。 无外力 Euler 方程的解是意外收获——约 100 个 Agent 工作了大约 50 小时,把它当作较容易的"热身题"时解决的。 OpenAI 表示,他们在过程中让不同组交叉借鉴彼此的中间成果,并用 Codex 汇总各组最有用的洞见。找到 Navier-Stokes 解的那个组就是在这种引导下工作的。 【两边叙事的关键分歧】 OpenAI 的时间线与 Buckmaster 声明的时间线有重叠但有微妙差异。 关于动机:OpenAI 说他们是 9 月 1 日听到“有两个千禧年问题被解决了”的传言后启动评估,传言并非专门针对 Buckmaster 的工作。而 Buckmaster 的声明描述的是:他的工作信息传到 OpenAI 后,OpenAI 才开始在同一条极冷门的技术路线上发力。 关于交涉:OpenAI 说他们 9 月 6 日完成全部证明和 Lean 验证后,“相信对方也有 Navier-Stokes 的解”,于是主动联系,提出联合发布并承认对方的优先权。但通话后发现 Buckmaster 和 Alpöge 的成果是带外力的 Euler,而非 Navier-Stokes。而 Buckmaster 描述的通话场景是 OpenAI 在信息不对等的情况下施压、要求移除合作者。 关于数据:OpenAI 在博客和推文中都明确否认访问过用户数据,但加了一句值得注意的话:“虽然可能性不大,但我们无法排除基于他们产品使用而生成的去标识化数据帮助改进了我们的模型”。Buckmaster 在声明中问过这个问题,没得到回答。 关于学术功劳:OpenAI 推文祝贺 Buckmaster 和 Alpöge 取得了"remarkable mathematical work",并承认对方在 Euler 问题上的优先权。但声明中没有任何文字提及 Córdoba 和 Martínez-Zoroa 的开创性工作——要知道整个受迫爆破研究计划是他们建立的。 【Bubeck 回应:指控不实】 Bubeck 在 X 上发帖,称关于他的指控“虚假且具煽动性”(false and inflammatory),表示自己是按照学术规范参与讨论的,对事态发展表示失望,并承诺次日将给出更详细回应。 截至目前,Bubeck 尚未对 Buckmaster 声明中的任何具体细节——Codex 数据问题、署名施压、“毁掉你的职业生涯”的说法——作出逐条回应。 【数学界在等什么】 Scientific American 的报道标题:“OpenAI 声称数学重大突破,争议缠身。” 多位数学家指出,虽然 OpenAI 已发布 Lean 代码,但社区尚未完成独立验证。Lean 形式化本身具有极高的可信度,如果代码能通过编译,证明在逻辑上就是正确的,但这仍然需要外部数学家实际运行和检查。 陶哲轩此前评价 Buckmaster/Alpöge 的工作时说,这些方法“没有原理上的障碍”推进到 Navier-Stokes,但他同时也说,他“不会对有人靠堆大量算力和 AI 来暴力推进这一步感到意外”,只是这种做法并不特别吸引我。在 OpenAI 宣布上万个 Agent 88 小时拿下成果后,回过头来读陶哲轩的话别有深意。 Clay 数学研究所的规则也值得提醒:即使证明成立,还必须在公认的数学期刊正式发表,并在至少两年的社区审查后才有可能获得千禧年奖。OpenAI 在博客中也表示不打算领取该奖金。 OpenAI 博客: openai.com/index/navier-s… 宝玉 @dotey 纽约大学数学家 Tristan Buckmaster 今天发表公开声明,披露了两件事:一是他和合作者借助大语言模型在一个月内攻破了流体力学领域多个重要难题,二是他指控 OpenAI 在得知他的进展后试图抢先发布成果,并要求将他的合作者从署名中移除,理由是对方在 Anthropic 工作。 这份声明目前正在数学界和 AI 圈快速传播,涉及学术伦理、AI 能力边界和公司竞争等多个层面。以下是这件事的来龙去脉。 【数学成果:证明了什么】 Buckmaster 与合作者 Levent Alpöge 公开了三项证明:不可压缩多孔介质方程、Boussinesq 方程以及三维不可压缩 Euler 方程的有限时间爆破(blowup),均使用了光滑外力(smooth forcing)。他们还认为自己得到了 Navier-Stokes 方程的爆破结果,但该部分的 Lean 形式化验证尚未完成,论文暂不公开。 翻译成大白话:这些方程描述的是水、空气等流体如何运动。数学家想知道的是,在光滑的初始条件下,流体的速度会不会在有限时间内变成无穷大,也就是"爆破"。这个问题的终极版本就是 Navier-Stokes 存在性与光滑性问题,Clay 数学研究所在 2000 年把它列为七大千禧年难题之一,悬赏一百万美元。 需要说清楚的是,Buckmaster 和 Alpöge 并没有直接解决那个百万美元的问题。他们证明的是一个相关但限制更多的版本:在加入光滑外力的条件下,方程的解可以爆破。这对应 Clay 问题中 Fefferman 表述的 c 和 d 选项。但这条路径是通向无外力 Euler 方程的重要一步,而无外力版本才是最终目标。 这项工作并非凭空而来。基础思路来自西班牙数学家 Diego Córdoba 和 Luis Martínez-Zoroa,他们多年来一直在研究带外力的爆破构造,已经在"粗糙外力"条件下取得了成果。Buckmaster 和 Alpöge 所做的是在此基础上推进到光滑外力和 Euler 方程。Buckmaster 在声明中直言:鉴于这一系列工作,他认为 Martínez-Zoroa 配得上 Fields 奖。 关键结果在 8 月 15 日获得,8 月 22 日通过 Lean(一种形式化证明验证系统)的机器检查。Lean 验证意味着证明没有逻辑漏洞,这不是"信我就行",而是有机器背书。 陶哲轩在成果公开后不久就在 Mastodon 上发表评价,称这是"a remarkable achievement"(了不起的成就)。他确认了 Lean 形式化验证的存在,也指出论文确实包含大量 AI 生成的内容,但作者过去几周一直在努力将其改写为可接受的形式。他提到一个关键细节:作者被迫提前发布,原因是"外部事件",也就是声明中记录的与 OpenAI 的冲突。 在技术层面,陶哲轩对这条研究路径给出了乐观判断:他认为没有什么原理上的障碍阻止这些方法一路推进到 Navier-Stokes,甚至有"不可忽视的可能性"完全消除外力项。如果后者成立,那就是 Clay 千禧年问题的完整解答。但陶哲轩随即加了一句耐人寻味的话:他不会对有人靠堆算力和 AI 来暴力推进这一步感到意外,但这种做法"并不特别吸引我"——他更感兴趣的是消化证明方法,提取其中的新数学洞见。 这基本上可以理解为:数学界最具权威的声音认可了成果的实质性,同时含蓄地为"人类+AI 合作"中什么才真正有价值画了一条线。 【AI 扮演了什么角色】 Buckmaster 和 Alpöge 在整个过程中大量使用了大语言模型,包括 Anthropic 的 Claude、OpenAI 的 Codex 以及 GPT-5.6 Sol,最近还用了 Astra(后者仅用于论文写作和论证审计)。 过去一年进展缓慢,两人一直在消化文献、逐步升级前置结果。真正的突破发生在大约一个月前。Buckmaster 坦言,Alpöge 发给他的第一个 LLM 生成的证明是他"读过的最恐怖的东西"。他们花了两周多时间去理解这个证明,并试图将其改写成人类可读的形式。他承认 Euler 方程的论文写作质量很差,甚至用了"AI slop"(AI 生成的垃圾内容)来形容。 Buckmaster 把这一刻比作国际象棋领域的"深蓝对卡斯帕罗夫"时刻:一个数学家配合 LLM,一个月内完成了原本可能需要数年的工作。他认为这对数学界如何培养学生、分配学术功劳、审稿以及决定什么值得一个人投入毕生精力,都有深远影响。 【与 OpenAI 的冲突】 事情从 9 月 3 日开始变味。当时网上已经有传言称"Anthropic 解决了一个重大数学难题",Alpöge 也收到线报说他们的进展信息已传到 OpenAI 内部。Buckmaster 主动写信给 OpenAI 的一位知名数学家,说明情况并强调这是个人合作,与任何机构无关。 对方当天回复,表示如果 Buckmaster 愿意透露细节会很有帮助,并提出可以提供算力支持。Buckmaster 提议下周通话,但 OpenAI 方面连续催促提前见面。9 月 6 日(周日),OpenAI 的 Sébastien Bubeck 加入,三人当天下午通了两次电话。 通话中,Buckmaster 被告知 OpenAI 的一个内部模型已经生成了一份大约 100 页的受迫 Navier-Stokes 方程有限时间爆破证明。Buckmaster 注意到,OpenAI 的技术路线与他和 Alpöge 秘密采用的路线高度重合,而这条路线几乎没有其他人在走。 声明中描述的通话过程暴露了几个问题。OpenAI 最初声称"极少人工参与",但随着对话推进(Bubeck 不断收到同事在内部聊天中发来的修正和补充),事实逐渐浮出水面:这是一整个团队在操作,投入了大量算力,先从较容易的问题(包括 Euler)入手,甚至展示给 Buckmaster 的提示词本身也是用 Codex 生成的。 Buckmaster 追问 OpenAI 是何时开始处理这个问题的。这个问题没有被直接回答,但最终双方确认:第一个提示词是在过去几天内发出的,也就是在 Buckmaster 的工作信息传到 OpenAI 之后。 Buckmaster 还问了一个关键问题:OpenAI 的模型是否被训练过他们在 Codex 中的会话数据——他和 Alpöge 整个项目期间一直把草稿放在 Codex 里。他被告知模型不会查看用户数据。他再次追问是否用于训练,没有得到回答。 随后 OpenAI 提出了两个方案:一是 Buckmaster 先发 Euler 结果,OpenAI 第二天发 Navier-Stokes 结果;二是 Buckmaster 独自撰写一篇论文发布 Navier-Stokes 成果,注明系 OpenAI 内部模型所得。Bubeck 两次明确要求将 Alpöge 从署名中移除,说如果不是因为 Alpöge 在 Anthropic 工作,一切会简单得多,还说他在 Anthropic 工作"太烦人了"。OpenAI 还表示,如果他们在 Buckmaster 之后发表,会公开说 Buckmaster 和 Alpöge 配得上 Clay 奖金,称他们是"最接近这个问题的人类"。 Buckmaster 拒绝了两个方案,并表示如果 OpenAI 按计划发布,他会公开所有经过。对方回应:"你为什么要毁掉自己的职业生涯?" Buckmaster 说自己是学术界的人,反问为什么公开会毁掉职业。回答是:"如果你不希望我友善,那我也可以不友善。" 之后 Bubeck 给 Alpöge 发短信,提议两人单独谈,并说"我不确定 Tristan 现在是否完全理性"。Alpöge 拒绝并表示应与 Buckmaster 沟通。 【Buckmaster 自己的界定】 Buckmaster 在声明末尾明确划了线:他没有看过 OpenAI 的证明,不知道 OpenAI 的模型做了什么或怎么做的,不知道他们的数据是否被使用,也没有指控任何人任何事。他说自己只是在陈述被告知了什么、何时被告知、以及被提议了什么。他这样做是因为"另一种选择是让一连串公告讲述他知道并非事实的故事"。 他说,如果 OpenAI 的模型确实弥合了通向 Navier-Stokes 的差距,那是一件了不起的事,应该被大声说出来,但要带上完整的历史。 PDF 地址: cims.nyu.edu/~tristanb/stat… 🔗 View Quoted Tweet 💬 1 🔄 0 ❤️ 3 👀 1673 📊 1 ⚡