ChatGPT Images 2.5 发布,但更火爆的是:一万个 agent 给出的千禧年难题的解答

作者:AGI Hunt 发布:2026-09-09 06:00 收录:2026-09-09 08:13 12 次阅读 约 8859 字
摘要:OpenAI 回应争议:未访问数学家数据
推荐理由:本文涵盖「Anthropic」、「Claude」、「OpenAI」等多个主题,重点关注 Anthropic。

今天凌晨,OpenAI 官宣:一个内部模型带着一万个 agent,用 88 小时给出了 Navier-Stokes 千禧年难题的解答。

OpenAI 官宣
OpenAI 官宣

而在这条官宣的十几个小时之前,也就是昨天中午,纽约大学的数学家 Tristan Buckmaster 已经先发了一份四页的声明。

他说自己和合作者 Levent Alpöge(在 Anthropic 工作)借助大语言模型(LLM),在一个月内得到了三个关于流体方程的「爆破」证明,也就是原本平滑的流动在有限时间内出现异常。

同时,他指控 OpenAI 在得知他们的进展后抢跑,还在电话里要求把 Alpöge 从署名里拿掉。

Buckmaster 的四页声明
Buckmaster 的四页声明

于是,过去这一天多,X 上的 AI 和数学圈可以说是彻底地炸了:陶哲轩、Sam Altman、Sébastien Bubeck、Noam Brown、Sholto Douglas 全都下场了,中间还有好多次反转。

这场争议牵涉到证明是谁先做出来的、论文该署谁的名字,以及研究过程中用到的数据。几方对同一通电话的描述,也有不少出入。

该争议火爆到…… 更快更强更聪明的 Image 2.5 模型也没人关注了


纳维-斯托克斯

01

开始之前,还是得先来说说这道题。

Navier-Stokes 方程是 19 世纪的两位数学家 Claude-Louis Navier 和 George Gabriel Stokes 留下来的一组偏微分方程,本质上是把牛顿第二定律用在流体上。

它把水、空气当成连续的介质,而不是去追踪每一个分子。

飞机机翼的气流、天气预报、血液在血管里的流动,工程上天天都在用它。

但工程上能用,和数学上能证明,完全是两码事。

1934 年,Jean Leray 证明了这组方程存在「弱解」:放宽对解的平滑程度的要求后,仍能找到满足方程积分形式的解。可这还不能保证,流动始终平滑、不会出现异常。

一个基本问题一直没有解决:在三维空间里,从一个光滑的初始状态出发,流体某些位置的速度,会不会在接近某个有限的时刻时越来越大,没有上限?

这里的「光滑」是数学术语,说的是描述流动的函数可以不断求导,并且各阶导数都连续。可以粗略理解为,流动及其变化没有突兀的断点。

这种在有限时间内失去光滑性的现象,数学上叫爆破(blowup),出现异常的地方叫奇点。速度变得没有上限,是这里讨论的一种爆破方式。

流体方程的爆破
流体方程的爆破

真实的水不可能流得无限快。如果方程中的速度出现这样的异常,原来的光滑解就没法继续描述之后的流动了。

2000 年,Clay 数学研究所把它列为七个千禧年大奖难题之一,悬赏 100 万美元。这七道题到现在只解决了一道(庞加莱猜想,Perelman 拒领了奖金……)。

这场争议里,「有没有外力」是个关键区别。

Charles Fefferman 为 Clay 数学研究所撰写了这道难题的正式说明,其中列出了四种可供证明的情形。

A 和 B 要求证明:在没有外力的情况下,从符合规定条件的任意光滑初始状态出发,流体都能一直保持光滑。C 和 D 则要求找出一个符合条件的初始状态和外力,让满足要求的光滑解无法一直存在。

四种情形还区分了两种空间:A、C 讨论无限延伸的三维空间;B、D 讨论「三维环面」,可以想成一个从一侧出去、就会从对面回来的盒子。

四种证明情形
四种证明情形

也就是说,构造符合规定条件的光滑外力,再证明流体会爆破,也属于 Clay 列出的解题方向

你可以把外力想成有人在持续搅动这杯水,但数学上这个「搅动」必须是一个精确定义的、处处光滑的函数,不能随便加一根搅拌棒。

而 Navier-Stokes 方程里有一项叫黏性,它有平缓速度差异的作用,让细小的流动结构逐渐消散,因此会抑制爆破。把黏性项去掉,就变成了 Euler 方程,描述的是理想流体。

Euler 方程的爆破问题本身不是千禧年难题,但它可以是研究 Navier-Stokes 的一步:先找到没有黏性时发生爆破的机制,再看加入黏性后,爆破是否仍然会发生。

Buckmaster 和 Alpöge 做的,是 Euler 这一步。OpenAI 宣称做的,是 Navier-Stokes 这最后一步。

Buckmaster 和 Alpöge

02

Buckmaster 是纽约大学 Courant 研究所的数学家,方向是流体力学和偏微分方程。Alpöge 则是一位数学家,目前在 Anthropic 工作。

按 Buckmaster 声明里的说法,两人的合作是纯粹的个人合作,不代表任何一家雇主。用的工具是他自己的科研经费付的钱,其中,给 OpenAI 付的账单还是不小的一笔。

而他们走的路线,既也不是自己开的,也不是 LLM 想出来的。

基本思路来自两位西班牙数学家 Diego Córdoba 和 Luis Martínez-Zoroa,他们多年来一直在研究如何构造带外力的爆破,但之前构造出的外力还不够光滑,达不到这道难题的要求。

Buckmaster 在声明里专门写了一句:

就凭这一系列工作,他认为 Martínez-Zoroa 配得上一枚菲尔兹奖。

而 Buckmaster 和 Alpöge 所做的事,便是接着这条路线,借助 LLM,让构造出的外力满足光滑要求,再把方法用到 Euler 方程上。

过去一年大部分时间里,进展都很慢,两人一直在啃文献、改进后续证明要用到的已有结论。真正的突破发生在 8 月 15 日:他们拿到了 Boussinesq 方程(一类描述浮力影响下流动的方程)和三维 Euler 方程在光滑外力下的爆破结果。

8 月 22 日,证明通过了 Lean 的形式化验证:把数学论证写成机器能检查的形式,再由 Lean 核对每一步推导是否符合给定的定义和假设

Euler 论文首页
Euler 论文首页

用到的模型有 Anthropic 的 Claude,OpenAI 的 Codex(主要是 GPT-5.6 Sol),以及最近的 Astra(只用来写论文和检查论证)。

Buckmaster 对那份 LLM 生成的初稿的评价是:

Levent 发给我的第一份 LLM 生成的证明,是我读过的最恐怖的东西。

从 8 月 22 日起,两人一直在没日没夜地工作,只为把这份证明改写成让人能读的样子。但最后放出来的版本,他自己都不满意,Euler 那篇他直接用了「AI slop」(AI 生成的低质内容)来形容,并为此向数学界道歉。

原因是被外部因素逼着提前发了……这个外部因素,便是下面的事。

他原本准备在发布时说的,其实是另一件事:

结果本身不是最重要的,重要的是一个数学家配上一个 LLM,现在一个月就能干完这些活。

他把这比作当年「深蓝」计算机击败国际象棋冠军卡斯帕罗夫的时刻,对培养学生、分配功劳、审稿、乃至决定什么值得一个人花一辈子去做,都会有深远影响。

论文放出后不久,陶哲轩在 Mastodon 上发了长评,开头是「一项了不起的成就」:

陶哲轩的评价
陶哲轩的评价

他确认了 Lean 验证的存在,也指出论文确实包含大量 AI 生成的内容,作者过去几周一直在努力改写。

他还特别提到,作者是因为「外部事件」被迫提前发布的。

技术上,这条路线是在已有的流动中,反复加入范围很小、在空间中起伏很密的扰动。大范围的流动会把这些细小扰动指数级放大,让它们在接近爆破时主导流动的变化,再重复这个过程。

在 Boussinesq 方程的情形下,扰动有多强、起伏有多密,最后可以用一个相当简洁的常微分方程来描述,也就是只追踪它们如何随时间变化。

可技术细节仍然让论文长达 76 页。

陶哲轩:原则上可以推到 Navier-Stokes
陶哲轩:原则上可以推到 Navier-Stokes

陶的判断是原则上,没有什么能阻止这套方法一路推进到 Navier-Stokes,甚至有「不可忽视的可能性」把外力项完全去掉。

“并不特别吸引我”
“并不特别吸引我”

但他紧接着表示:靠堆算力和 AI 把这一步硬砸出来,他不会感到意外,只是这种事「并不特别吸引我」,他更感兴趣的是消化证明方法,弄清楚这套方法带来了哪些新的数学认识。

9 月 3 日的传言

03

事情从 9 月初开始变味。

8 月 29 日,有人问 OpenAI 的 Noam Brown 什么时候去试试千禧年难题,他的回答是:已经试过了,一道都没解出来,不过还没往上砸大量的推理算力。

Noam Brown 8 月 29 日的回答
Noam Brown 8 月 29 日的回答

而与此同时,网上开始流传一条传言称,Anthropic 解决了一道重大的未解数学问题,甚至具体到「就是 Navier-Stokes,证明正在送审,会在 IPO 之前公布」。

这条传言的来源之一是 Andrew Curran 的一条「预测」。

传言传到什么程度了呢?

9 月 6 日前后,X 上已经有人在推演:如果 Anthropic 真的用内部模型解出来了,那 OpenAI 应该也能做出一份证明,而且抢在他们前面发……

传言发酵中的推演
传言发酵中的推演

9 月 3 日(周四),Buckmaster 收到了 Courant 同事转来的消息,Alpöge 也收到消息,说他们的进展信息已经传到了 OpenAI 内部。

Buckmaster 便主动给 OpenAI 的一位知名数学家写了封邮件,声明全文引用了这封信。

大意讲的是:

传言可能说的就是我们,但具体解决了什么问题外界很混乱;这是两个人的个人合作,没有任何机构参与;我们会很快把论文和可供 Lean 检查的证明一起发出来;我直接写信给你,是希望你们手里有事实,好在你们那边处理。

对方当天回复:

如果你愿意透露任何细节,会有助于避免在这里形成竞争。总的来说,数学家用我们的模型取得进展,我们总是很高兴。另外,如果需要 OpenAI 提供算力,我们很乐意。

Buckmaster 便提议下周再谈。

9 月 4 日(周五),对方问能不能当天见,他又说下周。到了 9 月 6 日(周日)中午 12 点 45 分,对方问他「今天任何时候」能不能通话。

Sébastien Bubeck 加入了,三个人当天下午通了两次电话,Alpöge 不在线上。

事件时间线
事件时间线

周日下午的两通电话

04

下面这一段,是 Buckmaster 声明里的版本。

Buckmaster 的声明
Buckmaster 的声明

他在电话里被告知:OpenAI 的一个内部模型已经生成了一份带外力的 Navier-Stokes 有限时间爆破证明,大约 100 页。

Alpöge 用短信追问,具体证明了什么。

得到的回答是:在三维空间(R³)和三维环面(T³)上,都能构造出在光滑外力作用下发生爆破的例子,对应 Fefferman 正式说明中的 C 和 D。

Buckmaster 没有看到这份证明。

他之所以立刻警觉,是因为「带光滑外力」这条路线是 Córdoba 和 Martínez-Zoroa 开出来的,他和 Alpöge 一直在悄悄地走,据他所知几乎没有别人在做。

用他的话说,这不是把题目描述丢给模型、几天之内就能自己走到的方向。

一听到「forced」(有外力作用),他就觉得很不对劲。

接下来是他描述的通话过程。

他被展示了一个 prompt,被告知给模型的只有题目描述,Alpöge 此前也被 Bubeck 告知「几乎没有人类参与」。

但随着通话推进,Bubeck 不断收到团队同事在内部聊天里发来的修正,事情慢慢变了样。

这是一整个团队在做,是尝试的多个方向之一,工作从无外力的问题开始,团队先让模型做了更容易的问题(包括 Euler),连展示给他看的那个 prompt 都是用 Codex 生成的,而且用掉了「疯狂的算力」。

他问对方第一个 prompt 是什么时候发出去的,但这个问题有一段时间没有得到直接回答,最后双方确认:是在过去几天里,也就是在他们的工作信息传到 OpenAI 之后。

声明中关于 Codex 会话的追问
声明中关于 Codex 会话的追问

他又问,模型有没有在他们的 Codex 会话上训练过,或者访问过。因为整个项目期间,他们把所有草稿都放在 Codex 里。

他得到的回答是模型不会查用户数据。

他再追问训练的事,没有得到回答。

Bubeck 声称的两个方案
Bubeck 声称的两个方案

然后对方提出了两个方案:

第一个,他们先发 Euler 的结果,OpenAI 第二天发 Navier-Stokes 的结果。第二个,发完 Euler 之后,由 Buckmaster 一个人写一篇论文来呈现 Navier-Stokes 的结果,注明是 OpenAI 的内部模型解决的。

按他的描述,Bubeck 两次明确表示希望把 Alpöge 从署名里拿掉,说要不是 Alpöge 在 Anthropic 工作,一切都会很简单,而这一点「太烦人了」。

对方还说,如果 OpenAI 在他们之后发布,会公开说他们配得上 Clay 奖,是「离这个问题最近的人类」。

Buckmaster 拒绝了两个方案,并说如果 OpenAI 按提议的方式发布,他会把经过公开。对方的回复是:

你为什么要毁掉自己的职业生涯?

他回答说自己是学术界的人,反问为什么公开会毁掉职业。对方说:

如果你不想让我友善,那我也可以不友善。

之后 Alpöge 收到了一条短信,提议他和 Bubeck 单独聊聊,里面有一句「我不确定 Tristan 现在是不是完全理性」。

Alpöge 拒绝了,说该跟 Buckmaster 谈。

当晚 Bubeck 又发邮件要求周一通话,Buckmaster 没有回复。

声明的末尾,他划下了自己的边界:他没有看过 OpenAI 的证明,不知道对方的模型做了什么、怎么做的,不知道他们的数据有没有被用过,他不指控任何人任何事。

他只是陈述自己被告知了什么、什么时候、以及被提议了什么,因为另一种选择是让一连串的公告去讲一个他知道不是事实的故事。

如果 OpenAI 的模型真的补上了通向 Navier-Stokes 的那一步,那是一件了不起的事,应该被大声说出来,由他们来说,但要带上完整的历史。

Codex 数据疑云

05

声明是北京时间 9 月 8 日中午前后传开的。

传播过程里,很多人把它读成了「OpenAI 偷看了他们的 Codex 会话」。

比如 Hugging Face 联合创始人 Thom Wolf 转述称:两人花了几个月和各种 AI 一起攻一道千禧年难题,OpenAI 最近几天听说之后,让最新模型去做他们找到的那个方向,然后试图控制成果的传播,还施压把 Alpöge 从署名里去掉。

Thom Wolf 的转述
Thom Wolf 的转述

不过「用 Codex 会话训练」这一说法,很快就有人出来泼冷水,甚至其中不少是 Anthropic 或者第三方的人。

Anthropic 的 Sholto Douglas 说,用户数据在这件事里起作用的可能性「极低」,OpenAI 不可能为此去拉用户的对话记录,也不会明知故犯地拿它训练。他不希望大家把事情传成「你的数据在 Codex 里不安全」。

Ai2 的 Nathan Lambert 说 OpenAI 或 Anthropic 的研究员直接查看特定用户数据的概率是零,他在 Meta 的时候这么干基本当场开除。

经济学家 Kevin Bryan 也直接称这是「愚蠢的谣言」:任何了解模型怎么训、数据合同怎么签的人都不会相信。

不过也有人指出了一个微妙之处:不需要看日志,只要知道那两个人用 AI 解决了与 Navier-Stokes 密切相关的问题,再加上一两句关于思路的描述,就足以让一个团队把巨量算力对准正确的方向。

有人的说法是,10 个 bit 的信息就可能把需要尝试的范围缩小到原来的约千分之一。

即少量线索也可能帮人排除大量错误方向。

Bubeck 本人在当天早些时候只发了一条简短的回应:

一系列针对我的虚假且煽动性的指控正在社交渠道上流传。我要说明的是,我是遵循学术规范参与这场讨论的,对事情走到这一步感到失望。了解我的人都知道,学术标准对我至关重要。明天会有更多要说的。

而 OpenAI 的 Joshua Achiam 发了一段被广泛转发的话,说数学是全人类的团队运动,超越公司之间的竞争;每个实验室的人都承受着「必须第一个发出关键结果」的巨大压力,但这不该压过更大的东西。

他还对指控本身做了一个不太一样的解读:Buckmaster 的说法似乎是,Bubeck 不愿意把 Alpöge 的名字挂在 Alpöge 没有贡献的 OpenAI 内部结果上,同时乐意让 Buckmaster 以第一作者身份去领这个功,而不是「把 Alpöge 从他自己的工作里除名」。

如果这么理解,事情的煽动性要小很多。

Buckmaster 当天也在 Mastodon 上表示,他对数学界的支持深表感谢,但这里有一个比声明本身大得多的故事,那便是前沿模型现在已经能做到什么程度,以及这对所有人意味着什么。

他希望各家实验室能看到这一点,把那些小家子气的姿态放到一边。

OpenAI 官宣

06

北京时间 9 月 9 日凌晨一点多,OpenAI 发了官方博客和 165 页的论文,标题是《On the Navier-Stokes Millennium Prize Problem》,并配上了 Lean 形式化证明的链接。

OpenAI 论文首页
OpenAI 论文首页

按 OpenAI 的说法,他们构造了一种从静止开始的流动:在光滑外力作用下,总能量始终有限,但局部速度在接近某个有限时刻时变得没有上限,对应 Fefferman 正式说明中的 C 和 D。

这个解描述的是一个漩涡,向内螺旋,同时被越拉越长(他们的比喻是意大利面),中心区域在收缩的同时加速,而能量仍然保持有限。

OpenAI 给出的漩涡解示意
OpenAI 给出的漩涡解示意

技术上的难点在于流动的加速、各处压力的差异、流体自身的运动和黏性,会在方程里产生很大的数值。要让这些部分精确地相互抵消,算出来所需的外力还得满足光滑要求。

而博客中「我们是怎么找到这份证明的」这一节,才是和争议直接相关的部分。

OpenAI 说,自 8 月 28 日起,他们一直在训练一个新的内部模型,在包括数学在内的多项基准上表现空前,训练还在继续。

9 月 1 日(周二),他们听到传言说两道千禧年难题已经被解决了,于是启动了一个项目:把内部模型放到所有尚未解决的千禧年难题上跑一遍。

OpenAI 博客:9 月 1 日启动,1 万个并发 agent
OpenAI 博客:9 月 1 日启动,1 万个并发 agent

项目用的是一套多 agent 系统,agent 可以查阅预先缓存的网页资料、可以跑代码,按组分工、组内互通。(重点:一万并发 Agent,内部黑科技啊!)

对每道题,他们给不同的 agent 组分发了不同版本的问题描述。Navier-Stokes 也分成了两类任务:一类尝试证明光滑解能一直存在(A、B),另一类尝试构造无法一直保持光滑的例子(C、D)。

一万个 agent 怎么分工
一万个 agent 怎么分工

除了正式题目,他们还给了一批「更简单」的问题,其中一个正是 Euler 方程的解能否一直保持光滑的问题。结果是大约 100 个 agent 花了约 50 小时,先把无外力版本的 Euler 爆破做了出来。

看到这个结果后,他们把其他千禧年难题上的 agent 都调过来集中攻 Navier-Stokes,并把 Euler 的解法喂给了这些 agent。

中途内部模型训出了更新的版本,agent 也换了过去。

他们还用 Codex 把各个 agent 组最有用的中间结果做了交叉整合,找到解的那一组正是这样被引导的。

OpenAI 博客:88 小时,490 万条消息
OpenAI 博客:88 小时,490 万条消息

agent 在 9 月 5 日(周六)得出了结果,距离第一批 agent 启动大约 88 小时。把证明转成 Lean 能检查的形式并完成验证,又用了 17 小时,是 GPT-6 Astra 做的。

Navier-Stokes 这一组的规模是一万个并发 agent,270 万条消息,约 1300 亿输出 token。 所有问题加起来,是 490 万条消息、约 3000 亿 token。

Noam Brown 补充说明了这份账单:是的,这个结果花了几百万美元

Noam Brown:内部模型与 GPT-6 Astra 的对比
Noam Brown:内部模型与 GPT-6 Astra 的对比

但当年 o3 在 ARC-AGI 1 上拿 87.5% 花了大约 50 万美元,今天 Astra 用 20 美元就能拿更高的分。

他预计一年之后,人人手边都会有一个能解这种级别问题的 AI。

博客里有一节专门写了「同期工作」。

OpenAI 说,项目是 9 月 1 日听到传言后启动的,后来才意识到传言和 Alpöge、Buckmaster 有关。

在整个项目和 Lean 验证完成(9 月 6 日)之后,他们以为对方也有 Navier-Stokes 的解,便主动联系,提议同步发布、在联合公告里承认对方率先取得成果。

到那时才发现对方手里的,是带外力的 Euler。

他们在讨论中提出可以让对方看到所有用过的 prompt,之后也可以看证明。他们承认对方更早得到了带外力 Euler 的结果,并向两人祝贺。

OpenAI 博客:同期工作与数据表述
OpenAI 博客:同期工作与数据表述

关于数据,博客里提到了「去标识化数据」,也就是去掉姓名、账号等身份标识后的使用数据:

我们(研究人员和 agent)在他们公开发布之前,没有通过任何途径看到过他们的工作,尤其是,没有访问任何特定用户的数据来解决这个问题。虽然可能性不大,但我们不能排除,源自他们使用我们产品的去标识化数据,帮助改进了我们的模型。不过,我们的证明有显著差异,连 Euler 情形下证明的具体结论都不同(受迫 vs 非受迫)。

博客还写道:OpenAI不打算为这个结果申领千禧年大奖。

Bubeck 的四点回应

07

OpenAI 官宣二十分钟后,Bubeck 发了他承诺的「明天」的回应,一共四点,配了一张他和 Alpöge 的短信截图。

Bubeck 发给 Alpöge 的短信
Bubeck 发给 Alpöge 的短信

第一点,截图是他主动联系 Alpöge 协调双方的发布,他希望大家能从这条短信里看出,他们是带着最大的善意来的。

短信里写道:内部模型在极少人类输入的情况下产出了 Navier-Stokes(简称 NS)的证明,既有可供机器检查的版本,也有普通数学文本的版本。

但对他们来说最重要的是承认「你们」率先取得成果,这个历史性结果的所有学术荣誉都归你和 Tristan,我们准备把手上的一切都分享给你们,包括人类写的 prompt。

第二点,他「从来没有」要求把 Alpöge 从他自己工作的署名里拿掉。

他是在和 Buckmaster 通话时才惊讶地得知,对方解决的只是 Euler 而不是 Navier-Stokes。

此后双方讨论了几种合作方案,其中一条是让 Buckmaster 做 OpenAI 那份 NS 证明重写版的第一作者。他说「要是 Levent 不是 Anthropic 员工就简单多了」正是在这个语境下,因为他觉得让一个 Anthropic 员工去署名 OpenAI 的工作不合适。

他还提到,通话中对方承认 Euler 证明里用了 Anthropic 的内部模型,所以他没法把 Alpöge 当成独立的学者。

另一个他想提但没来得及提的方案,是让对方访问 OpenAI 的内部模型,去补完从 Euler 到 NS 的那一步,但他不知道该怎么把涉及公司知识产权的内部模型开放给一个 Anthropic 员工。

第三点,他说通话一开始就遭到了「一连串的诽谤」,包括直接的威胁:如果 OpenAI 宣布 NS,对方会立刻去找媒体,抛出一堆没有根据的指控。

他反驳了这些指控,对方的回答是「你什么也做不了,我就是不信任你」。

他说自己不理解为什么有人要把一个本该庆祝的时刻(庆祝的还是对方自己的成就)变成争吵,于是说了那句「我不明白为什么有人要拿自己的职业生涯去冒险」。他为这个措辞道歉:

我为这个极其糟糕的措辞深深道歉,它和我想表达的正好相反。(顺便说一句,我当场就收回了这句话。)

第四点,他说这些对话在个人层面上极其艰难。

他反复邀请,Alpöge 拒绝参加任何一次会议。他觉得自己是在和 Anthropic 做一场「代理谈判」,而那位 Anthropic 员工拒绝直接参与。

紧接着,他又补了四条技术性说明。

OpenAI 是因为 X 上疯传「Anthropic 解决了两道千禧年难题」才开始攻关的,目的是看自家系统能不能做到。

在对方公开之前,他们没有看到过对方的任何工作,事后看两边的证明差异显著。

是 Alpöge 在周三主动联系了 OpenAI 的一名员工。由于 Alpöge 在 X 上发过大量看起来代表 Anthropic、使用 Anthropic 内部模型的帖子,他们当时认为这个项目至少部分是 Anthropic 的项目。

关于人类参与的程度,他说虽然有一群人参与,但他们都缺乏从事流体力学研究所需的专业知识,无法对数学内容做实质性贡献。

Noam Brown 则针对「偷 prompt」的猜测回应称:他理解看着今天的 LLM,人们会觉得唯一的办法便是用 Levent 和 Tristan 的 prompt;但他希望那张对比图能说明,用的模型比今天的 LLM 高出一大截。

没有人看过他们的 prompt,那太疯狂了。

Sam Altman 也发了声明,说他周末大部分时间都在和做这项工作的团队交流,Seb 和所有人自始至终都保持了正直和慷慨。

OpenAI 起初以为对方也解决了问题,想联合发布;得知对方只有 Euler 之后,提出让对方先发、建议奖项归对方、也可以让 Buckmaster 担任重写版的第一作者。

他们觉得很难向 Alpöge(Anthropic 员工)提供同样的安排,而对方本来也不愿意和他们沟通。「对方团队用没有根据的抄袭指控威胁我们。」

他还补充说,现在能看到对方的工作了,两边的方法看起来是不同的。

Alpöge 的回应

08

OpenAI 官宣之后,Alpöge 终于发声了。他引用了博客里「不能排除去标识化数据」那句话,然后说:

我得说,他们能直接坦白,这一点值得点赞。

他透露,目前看 OpenAI 的证明更像他们手里另一份 Euler 爆破证明的路数。

至于合作,他说自己其实本来会很乐意一起做,OpenAI 有很多他喜欢的人,署名他也不在乎,「Tristan、我,加上 OpenAI 的每一个全职员工都挂上去,我都无所谓」。

但当他在走廊里听到那通电话,尤其是听到「只要把我从论文里拿掉,就能拿到千禧年大奖」的那一部分时,他觉得这件事已经没有合作的余地了。

这事挺荒唐、不讲策略也没必要,因为我这边基本上就是我和 Claude 在角落里随便玩玩,根本不是什么机构行为。

而 Buckmaster 看完 OpenAI 的博客后,在 Mastodon 上引了「自 8 月 28 日起我们一直在训练一个新的内部模型」这句话,问了一个问题:

他们公开承认用了我们做出结果之后那段时间的训练数据。用客户的数据去截胡客户,这合乎伦理吗?

两边说法的对照

09

最后,其实能看出许多地方其实是没争议的。

两边说法对照
两边说法对照

双方都承认的

•  OpenAI 是在 9 月初听到传言之后才开始做这道题的 

•  OpenAI 在对方公开之前没有看过他们的论文 

•  9 月 6 日的电话里确实提出了「让 Buckmaster 先发、OpenAI 次日发」和「Buckmaster 单独署名 OpenAI 的 NS 结果」这两个方案 

•  Bubeck 确实说过那句关于「职业生涯」的话,他自己承认措辞极差、当场收回 

•  两边的证明方法不同,OpenAI 的 Euler 结果是无外力的,Buckmaster 他们的是带光滑外力的 

各执一词的,主要是三处。

一是「移除署名」到底指什么。

Buckmaster 的表述是「Bubeck 两次明确表示希望把 Levent 从署名里拿掉」;Bubeck 的表述是,他指的只是 OpenAI 自己那份 NS 证明的重写版不适合让 Anthropic 员工署名,从没碰过对方 Euler 论文的署名。

Achiam 的解读偏向后者,但 Alpöge 说他在走廊里听到的是「把我从论文里拿掉就给千禧年大奖」。

二是谁先威胁了谁。

Buckmaster 说他只是表示会公开经过,然后被问「为什么要毁掉自己的职业生涯」;Bubeck 说对方一上来便是一连串诽谤和「去找媒体」的威胁;Altman 说的是「用没有根据的抄袭指控威胁我们」。

三是 Alpöge 的身份。

OpenAI 一方的判断是这至少部分是 Anthropic 的项目,理由是 Alpöge 的公开发帖和「Euler 证明用了 Anthropic 内部模型」这一点。

Buckmaster 的邮件从一开始就强调这是纯个人合作,数学家 Dean Yang 也在 X 上说两人只用了市面上买得到的模型,经费来自 Buckmaster 的科研拨款。

Alpöge 自己的描述则是「我和 Claude 在角落里随便玩玩」。

至于最敏感的数据问题,目前则是 OpenAI 明确否认访问过特定用户的数据,但没有否认「去标识化的使用数据可能帮助改进了模型」。

Buckmaster 从头到尾都说「我不知道我们的数据是否被使用」;而多位圈内人认为直接查看用户会话在大厂几乎不可能发生。

陶哲轩的担忧

10

还有一个值得关注的,是在 9 月 5 日,也就是传言四起的那几天,陶哲轩在 Mastodon 上写道:

给 AI 公司提议一场新的竞赛:与其争着第一个宣布解决了某道未解的数学问题,不如争着第一个宣布一个新的数学洞见。

9 月 7 日,他又写了一段更长的话,说数学史上第一次出现这样的局面:纯数学里尚未解决的问题,本身是数学发现的主要燃料之一,现在正被当作一种不可再生资源来开采

如果开采的方式很粗糙,数学从中获得的净价值,可能远远小于以一种负责任、可持续的方式去解决它。

所以他对 Buckmaster 论文的评价是:「靠堆算力硬砸出来我不会意外,但这不吸引我」。

陶哲轩的补充:另一个独立的 Euler 结果
陶哲轩的补充:另一个独立的 Euler 结果

陶还提到了一个巧合,就在同一时间,Ganeshram、Duruisseaux 和 Anandkumar 也放出了一项完全独立的 Euler 爆破研究,找到了可能发生爆破的流动形态。

但他们走的是一条更常见的路线:把物理方程的约束加入神经网络,靠它来寻找这样的流动。

不同的是严格证明还没完成,AI 参与得也相对少。

后续

11

事情到今天还没有结束。

OpenAI 那 165 页的证明,数学界还没有来得及认真审。

虽然通过了 Lean 验证,意味着写入系统的推导通过了机器检查;但定义和假设是否准确对应原问题,还需要核对。

而一份 165 页、由一万个 agent 参与完成的论文,消化起来还是太费人了……

Clay 的规则是,解答需要正式发表,并在发表两年后仍被数学界普遍接受,才会进入评审。

可 OpenAI 已经声明了说不申领奖金,那这个奖最终会给谁、会不会给,又成了个新的问题。

此外,Buckmaster 和 Alpöge 手里还有一份「次耗散」Navier-Stokes(耗散机制比通常版本更弱,抑制细小流动变化的作用也更弱)的爆破证明,因为 Lean 验证没跑完,所以暂时没放出来。

Buckmaster 说它「暗示了一条通向无外力 Euler 的路」。

至于 Anthropic,官方到目前为止没有任何表态……

◇ ◆ ◇

•  Buckmaster 声明全文:https://cims.nyu.edu/~tristanb/statement.pdf 

•  Euler 论文:https://cims.nyu.edu/~tristanb/euler.pdf 

•  Buckmaster / Alpöge 的 Lean 仓库:https://github.com/tristanbuckmaster/fluid_lean 

•  陶哲轩的评价:https://mathstodon.xyz/@tao/117233527638291447 

•  OpenAI 官方博客:https://openai.com/index/navier-stokes-solution/ 

•  OpenAI 论文:https://cdn.openai.com/pdf/32d9f210-8b73-45e0-91bc-82a30aef8a9a/navier-stokes.pdf 

•  Bubeck 的回应:https://x.com/SebastienBubeck/status/2097379411691516310 

•  Noam Brown 的回应:https://x.com/polynoamial/status/2097381286193316203 

•  Sam Altman 的声明:https://x.com/sama/status/2097385167002415140 

•  Alpöge 的回应:https://x.com/alpoge/status/2097383870773748190 

•  Clay 数学研究所的正式问题说明(Fefferman):https://www.claymath.org/millennium/navier-stokes-equation/ 

转载声明:本文转载自原发布平台 (作者:AGI Hunt), 原文标题《ChatGPT Images 2.5 发布,但更火爆的是:一万个 agent 给出的千禧年难题的解答》, 查看原文。 版权归原作者及原发布平台所有,本站仅作收录与展示,未对正文内容作实质性修改; 若涉及侵权请联系本站处理。