OpenAI 那个还没发布的内部模型据说解决了纳维-斯托克斯存在性与光滑性问题
OpenAI 在 9 月 8 日宣布,他们一个能力显著强于 GPT-6 Astra 的内部未发布模型,解决了克雷数学研究所定义的七个「千禧年大奖难题」之一——纳维-斯托克斯(Navier-Stokes)问题。简单来说,这次的证明和 Lean 形式化验证显示,一个初始光滑、静止且具有有限能量的三维不可压缩流体,在光滑外力的驱动下,可以在有限时间内产生无界速度,其机制像是一个向内螺旋并像意大利面一样拉长的涡旋,核心在收缩的同时在加速。
这次解决问题的过程细节挺硬核,但也充满了争议。根据 OpenAI 的公开信息,整个时间线是这样的:
- 9 月 1 日:OpenAI 听到有传闻说两个千禧年问题被解决了,于是启动了针对这些问题的 Agent 攻坚。起初有近 100 个 Agent 跑了大约 50 小时,解决了无外力欧拉爆破(unforced Euler blowup)问题,随后资源全部转向 Navier-Stokes,投入了约 10,000 个并发 Agent。
- 9 月 5 日:在启动 88 小时后,Agent 达到了结论。随后使用 GPT-6 Astra 进行了 17 小时的 Lean 形式化验证。
- 整个这一周的尝试,总共消耗了 3,000 亿个输出 Token。按照 Astra 目前的计费率,这波计算成本大约在 2,250 万美元。
- 9 月 7 日:NYU 的 Tristan Buckmaster 和 Anthropic 的数学家 Levent Alpöge 发表了关于强迫欧拉爆破(forced Euler blowup)的结果,他们主要使用了 Claude 和 OpenAI 的 Codex。
- 9 月 8 日:OpenAI 正式发布证明、预印本和 Lean 文件。
更戏剧化的是,Buckmaster 声称 OpenAI 的 Sébastien Bubeck 曾要求他删除 Alpöge 的贡献,甚至在 Buckmaster 决定公开此事时,Bubeck 问他「为什么要把自己的职业生涯毁掉」。不过 Bubeck 否认了这些说法,认为其具有煽动性,并表示 OpenAI 团队在流体力学方面并没有研究级别的专业知识。
OpenAI 方面则否认研究员或 Agent 在发布前见过该团队的工作,且没有访问具体用户数据。不过他们承认,不能排除产品使用过程中去标识化的数据对模型改进有帮助。在 9 月 10 日的更新中,OpenAI 表示调查确认 Buckmaster 前两个月使用 Codex 的 Prompt 并没有影响这次结果。
目前克雷数学研究所依然将该问题列为「未解决」,因为这需要长时间的审视和广泛认可。OpenAI 表示他们不会领取那 100 万美元的奖金。数学界对此反应不一,陶哲轩批评实验室把著名的数学问题当成营销噱头;另有 25 位菲尔兹奖得主签署公开信,警告这种仓促的宣布会引发严重的归属权和抄袭质疑。在压力下,OpenAI 在周四撤回了对加州理工学院一个数学活动的赞助。
从技术角度看,用 10,000 个 Agent 暴力轰击数学难题,以及花费 2,000 多万美元去跑 Token 验证,这种「算力换证明」的路径确实很 OpenAI。但数学证明的严谨性不在于速度,而在于同行评议的认可度,这次争议反映出 AI 实验室在介入传统基础科学时,与学术界在信誉和归属权上的严重脱节。
全部回复 (3)
想当场把话说完?进全球 AI 聊天室,登录就能开口。

天呐,我当年死磕这个证明差点把头发掉光,要是早出这种模型,我至于在那本破教材上画了三个月的流线图吗?