OpenAI

OpenAI用88小时攻克千禧年难题

一个尚未公开的内部模型,带着约1万个AI智能体,只用了88小时,就拿下了纳维-斯托克斯方程的存在性与光滑性问题。

文|反应堆Reactor  

数学界又炸了。

就在昨天,OpenAI官宣:一个尚未公开的内部模型,带着约1万个AI智能体,只用了88小时,就拿下了纳维-斯托克斯方程的存在性与光滑性问题。

这可是七大千禧年难题之一,悬赏100万美元,过去90年无人攻克。

随声明一同放出的,还有一份长达 166 页的完整数学推导论文,以及配套的 Lean 形式化数学验证代码。

对此,Sam Altman 表示:

“对我而言,在 OpenAI 历史上最震撼的时刻之一,就是过去这周里亲眼见证了这一切的发生。”

Greg Brockman 也称:“这标志着 AI 与数学领域的重大里程碑,同时也预示着科学探索即将迎来一场全新的复兴。”

但还没等数学圈把掌声送出去,一场署名风暴已经席卷了X和各大平台。纽约大学数学家Tristan Buckmaster公开指控:OpenAI是在听说他和Anthropic研究员Levent Alpöge快做出来之后,才启动这个项目的。

更离谱的是,OpenAI还想把Anthropic的员工从作者名单里拿掉。

一道纯数学题,硬生生被演成了硅谷商战片。

先说说这道题到底有多难。

纳维-斯托克斯方程描述的是流体怎么运动。浴缸里的旋涡、飞机周围的气流、天气变化,背后都是它在起作用。

方程本身写出来并不复杂,但一个根本问题困扰了数学界90年:一个初始光滑的三维流体,在方程描述下会永远光滑,还是会在某个时刻突然出现“奇点”,流速趋于无穷大?

这个问题从1934年一直悬到今天。2000年,克雷数学研究所把这个问题列为七大千禧年难题之一,谁解出来谁拿走100万美元。

OpenAI给出的答案是:会爆。

论文构造了一个特定的涡旋流,流体沿竖直轴螺旋向内,核心区域越旋越细,像一根不断拉长变细的意面。在这个过程中,流速在有限时间内趋于无穷,但动能始终保持有界。

OpenAI表示,这份证明完成了克雷研究所官方题目中的C和D两种情况,纳维–斯托克斯千禧年难题就此解决。

证明是怎么来的?约1万个AI智能体并发协作,整个流程从9月1日启动,9月5日突破。中间有近100个Agent先花了50小时解决了无外力欧拉方程的爆破问题,给后续提供了思路。

整个过程Agent之间交换了490万条消息,消耗约3000亿输出Token。后续Lean形式化验证由GPT-6 Astra完成,又花了17小时。解题的算力成本达到了数百万美元。

Agent 使用的内部模型被 OpenAI 描述为「能力远超 GPT-6 Astra」。

OpenAI说他们不打算领那100万美元奖金,定位是“AI进步的一张快照”。

然后,争议来了。

纽约大学数学家Tristan Buckmaster和Anthropic研究员Levent Alpöge,过去一年一直在研究流体方程爆破。这条技术路线最早来自数学家Diego Córdoba和Luis Martínez-Zoroa,并非主流路径。

8月15日,两人取得了三维不可压缩欧拉方程的有限时间爆破结果;8月22日通过Lean验证。陶哲轩看后评价是“一项非凡的成就”。

问题在于,两人在研究过程中大量使用了OpenAI的Codex,论文草稿、证明和中间推导都放在里面。

9月1日,OpenAI听到“两个千禧年难题已被解决”的传闻,启动了Agent项目。9月3日,Buckmaster主动联系OpenAI解释情况。9月5日,OpenAI的1万个Agent完成了证明。

也就是说,当数学家还在改AI生成的草稿时,OpenAI已经用1万个Agent和几百万美元算力冲过了终点线。

Buckmaster质疑:我们走的是一条几乎没人在研究的冷门路线,OpenAI为什么在同一天用同样的方法启动?我们的草稿存在Codex里,这些数据有没有被用来训练模型?

OpenAI的回应是:研究人员和Agent在对方公开发布前没有看到过任何工作,也没有为了解题访问特定用户数据。

但紧接着补了一句:

“虽然不太可能,但我们无法排除他们使用我们产品所产生的去标识化数据帮助改进了我们的模型”。

这话翻译一下就是:没偷看你的论文,但不保证你的数据没帮上忙。

此外,署名之争更是一地鸡毛。

Buckmaster在公开声明中说,OpenAI研究员Sébastien Bubeck在通话中提出了两个方案:要么两组成果分开发布;要么由Buckmaster独自撰写OpenAI证明的改写版,但署名不能包含Alpöge,因为他是Anthropic的员工。

据Buckmaster转述,OpenAI反问Buckmaster:“你为什么要毁掉自己的职业生涯?”

Bubeck随后在X上发长文回应。他承认“职业生涯”的措辞“极其不当”,但否认那是威胁,说当场就收回了。

关于署名,他的说法是:当时讨论的是由Buckmaster主笔改写OpenAI的证明,让一名Anthropic员工署名OpenAI的工作不合适。

Sam Altman也下场站台,说Bubeck“自始至终以诚信和慷慨行事”,强调OpenAI最初以为对方也解决了同一问题,想合作联合发布,得知对方只有欧拉结果后,提出让对方先发。

但Alpöge在X上发帖表示,OpenAI提出只要去掉他的署名就可以与Buckmaster共享奖金。

公说公有理,婆说婆有理。唯一确定的是,数学成果的归属问题第一次被AI时代的公司竞争搅成了一锅粥。

这道题,OpenAI真的算“解了”吗?

微妙的地方在于:OpenAI证明的是带光滑外力的纳维-斯托克斯方程爆破,给流体施加一个精心构造的外力,让它爆。

克雷官方题面确实允许C和D两种情形包含光滑外力。从这个角度说,OpenAI完成了白纸黑字的要求。

但过去几十年数学家真正关心的核心版本,通常是无外力情况下方程能否自己形成奇点。

Buckmaster和Alpöge攻克的正是无外力欧拉方程——那是通往无外力纳维-斯托克斯的关键一步,但还不是终点。

陶哲轩此前判断,从欧拉方程的结果继续推进到带黏性的纳维-斯托克斯,“看不出有什么根本性障碍”。但“看不出障碍”和“已经证明”之间,还隔着一道坎。

按照官方题面,OpenAI可能已经通关;按照大家默认的终极版本,打的又不完全是同一个Boss。

事实上,这场风波引出三个思考:

1、AI助手里存的数据算谁的?

2、AI证明的署名该怎么算?

3、也是更深层的问题:数学的价值到底在哪?

数学家Jordan Ellenberg说过一句话:

“一个有趣却错误的例子,其价值高于一个无趣但正确的例子。”

Lean验证几乎能保证正确性,剩下的问题是:它是否带来了新的理解?

克雷千禧年问题页面上引用过一句话:

“为什么要求证明?因为证明给出的不仅是确定性,还有理解。”

答案现在有了。但谁给出了它、以及一台机器给出的正确证明是否等同于一位数学家给出的正确证明,这些问题才刚刚被提出来。

克雷研究所的裁定、同行评审的结论,以及数学界对AI证明的态度,将在未来两年内交汇。

到那时我们才能回答:AI能否与人类在数学上和谐共存。至少现在看起来,答案还没那么和谐。

对OpenAI而言,此刻真正的课题并非解题本身,而是如何理解这个模型的能力边界,并据此规划下一阶段的跃迁。这场88小时的数学突破,或许只展现了下一代模型能力的冰山一角。

广告等商务合作,请点击这里

本文为转载内容,授权事宜请联系原著作权人。

打开界面新闻APP,查看原文
界面新闻
打开界面新闻,查看更多专业报道

热门评论

打开APP,查看全部评论,抢神评席位

热门推荐

    下载界面APP 订阅更多品牌栏目
      界面新闻
      界面新闻
      只服务于独立思考的人群
      打开