拆解1万个Agent:OpenAI攻克千禧难题?

AI科技评论 · 经八阕原文

9 月 8 日,OpenAI 公布了一套针对 Navier–Stokes 千禧年问题的有限时间奇点构造。一个仍在训练的内部模型,配合约 1 万个 Agent 持续搜索约 88 小时,随后又用 Lean 完成形式化。

按照 OpenAI 给出的结果,这套构造能够让三维流体在光滑外力和有限动能条件下,演化到局部速度无界。

消息出来后很快引发争论。航空航天工程教授 Chris Combs 提醒,这并不等于得到了一套可以直接计算任意流体运动的通用解法,对现有 CFD 工作也不会立刻产生明显变化;数学侧讨论的则是三维光滑解能否一直维持正则性,有限时间 blow-up 本身就击中了这个命题。

与此同时,纽约大学数学家 Tristan Buckmaster 与 Anthropic 研究员 Levent Alpöge 的相近研究也被卷入讨论,让这件事又多了一层研究路线和成果来源的问题。

抛开外围争论,回到这件事的技术层面,或许可以拆解成三个方向,OpenAI 是如何先找到一个在黏性存在时仍能持续收缩的奇点结构,再把这个结构留下的发散残差重新吸收进流体自身的非线性,最后还要在大量互相牵制的条件之间找到一套能够整体闭合的证明架构的?

OpenAI和人类数学家,各自到底做了什么?

在去试图看懂这份 100 页的证明之前,我们必须先厘清一个被 OpenAI 模糊掉的关键事实:AI 并没有凭空顿悟流体力学的终极奥秘,它只是暴力加速了人类数学家的灵感。

这也是为何纽约大学著名数学家 Tristan Buckmaster 会在社交媒体上出离愤怒的原因。据推特多位学术大V及业内人士透露,OpenAI 极有可能是在某些渠道(如学术交流或未公开的预印本)提前获悉了 Buckmaster 团队的核心解题框架,随后动用了令人绝望的内部算力进行了抢跑(Scooping)。

更有戏剧性的是传闻指出,OpenAI 提出可以让 Buckmaster 担任这篇历史性论文的“第一作者”,但附带了一个极度排他的霸王条款:必须将团队中在 Anthropic 工作的合作者(Levent Alpöge)踢出局。

抛开大厂排挤死对头的公关戏码,如果我们用技术视角重新审视这场“抢跑”,就能清晰地看到 人类顶尖心智与 AI 算力霸权 在这场世纪证明中的分工:

▎人类数学家(以 Buckmaster 等人为代表):负责“搭骨架”与“物理直觉”。

Navier-Stokes 的难点在于非线性放大和黏性耗散的冲突。人类数学家贡献了最核心的破局思路:他们构想出了“故意偏离临界尺度”、“高频振荡脉冲”以及“剥离局部速度与整体动能”等极其精妙的数学结构。

这些需要跳跃性思维的几何与物理直觉,目前的 AI 依然无法实现从0到1(而这也是科学研究最重要的一步)的过程。

▎OpenAI 的 1 万个 Agent:负责“填血肉”与“高维约束搜索”。

有了骨架,接下来就是苦力活。证明需要同时满足自相似尺度、局部剪切、应力锥等数十个互相牵制的高维非凸约束条件。

人类数学家可能需要耗费数年时间去试错、微调参数,而 OpenAI 动用了约 1 万个内部 Agent,在短短 88 小时内,穷尽了所有可能的分支,从庞杂的假设空间中“搜”出了一套能够整体闭合的数学构造,实现了“抢跑”。

▎Lean 与 Comparator:负责“防幻觉”的终极锁死。

算力给出的答案可能存在逻辑漏洞。OpenAI 最后用形式化工具 Lean 将这套庞大的证明死死钉在逻辑系统里,确保 Agent 在疯狂探索时没有悄悄篡改原始命题的条件。

理清了这层分工,我们再来拆解 OpenAI 这份百页证明中的技术细节:

奇点构造的关键,是故意偏离临界尺度

Navier–Stokes 的麻烦,在于非线性放大和黏性耗散会同时随着尺度缩小而增强。涡量拉伸不断把流动压向更细的空间结构,黏性则恰好对这些高频结构作用更强。只要两边的强度关系稍有偏差,要么奇点被耗散抹平,要么能量、压力和外力一起失控。

因此,OpenAI 首先做的不是寻找一个单纯旋转更快的流场,而是设计一套各向异性的自相似尺度。

它从轴对称带旋流的涡核出发。接近奇点时,涡核在径向快速收缩,轴向也收缩,但速度略慢,核心因此逐渐变成一根越来越细长的旋转流体柱。

径向流不断把流体送向旋转轴,角动量输运随之推动旋转加速;不可压缩条件又要求进入核心的流体沿轴向排出,于是径向压缩、角向加速和轴向拉伸形成一个能够持续运转的动力结构。

真正关键的是,OpenAI 没有让三个方向按照同一种尺度变化,而是引入一个很小的指数偏置。

这个偏置先解决了速度发散和有限动能之间的冲突。随着奇点接近,局部速度越来越高,但高速区域的空间体积缩小得更快,于是点态速度可以走向无界,整体动能却仍然受到控制。换句话说,奇点不是整个流场一起变得越来越暴烈,而是被不断压缩进更小的核心区域。

更深一层,这个偏置还重新安排了黏性在不同方向上的作用。径向方向仍然维持输运与黏性扩散的主阶竞争,角向旋转的惯性作用却持续增强,轴向扩散则逐渐退到次一级。

这样一来,黏性并没有被排除出构造,而是被限制在特定方向上承担稳定结构的作用,同时给旋转和拉伸留下增长空间。

但到这里仍然只解决了“怎样制造奇点”这一件事。一个能 blow-up 的自相似涡核,并不意味着它已经是 Navier–Stokes 的合法解。

内部结构和外部平滑流场连接以后,会不可避免地产生动量失衡。如果这部分误差随着奇点一起发散,那么奇点只是被外力硬推出来,整个构造依然不成立。

于是问题自然进入下一层:不仅要制造奇点,还必须让奇点留下的误差具有可修正结构。

真正困难的是残差

OpenAI 把内部自相似涡核接到一个由黏性扩散控制的外部流场,两者之间留下一个环形过渡区。内部负责形成奇点,外部负责保持平滑,真正难处理的动量残差便集中在这个过渡区域。

如果直接把这些残差定义成外力,外力本身很可能随着奇点时间接近而失控。于是证明需要完成一个更苛刻的转换:把原本应该由外力承担的误差,转化成流体内部细尺度运动自己产生的动量输运。

这正是高频振荡脉冲出现的原因。这些脉冲的平均速度可以很小,因此不会明显改变背景流。

但 Navier–Stokes 的非线性包含二次耦合,细尺度速度相互作用后仍能留下稳定的平均动量通量,也就是雷诺应力。这样一来,系统可以先计算背景流缺少什么方向的动量输运,再反过来设计振荡,让它们通过二次相互作用生成对应的有效应力。

问题到了这里,已经不再是简单的“把误差压小”,而变成“能不能合成出所需方向的应力”。

不同振荡模式能够制造的动量通量比例受到限制,几类波形组合以后,只能覆盖一个特定的应力锥。背景流留下的目标残差必须落在这个锥体内部,才能通过调节脉冲强度被表示出来。如果目标应力跑到锥体外面,增加振幅没有意义,因为缺失的不是强度,而是方向。

这一步反过来要求重新修改背景流。OpenAI 使用小振幅、高频率的径向微扰去调整局部剪切。微扰本身很弱,所以原来的流场剖面和整体积分量变化有限;但高频会明显放大导数,因此局部剪切能够得到较大调整。

剪切一变,振荡脉冲能够产生的应力方向也跟着变化,于是原本落在锥体外的目标残差,就有机会重新进入可实现区域。

但这种高频调整又会带来新的问题:局部剖面虽然修好了,原先已经匹配好的径向矩条件可能被破坏。

所以系统还需要加入低频修正,把这些整体约束重新补回来。这里形成了一种明确的多尺度分工:高频结构负责改局部导数和剪切方向,低频结构负责维护整体积分条件和外部匹配。

来源:AI科技评论(经八阕转载) · 查看原文
Scroll for more