OpenAI 公开了纳维–斯托克斯的证明和 Lean 形式化,同时说明不申领千禧奖——因为证的不是经典那一版

OpenAI 于 9 月 8 日宣布在纳维–斯托克斯存在性与光滑性问题上取得结果,9 月 10 日公开完整技术说明、论文与可机器校验的 Lean 形式化,并表示不会申领克雷数学研究所的百万美元千禧奖。规模数字很具体:近 1 万个 agent 并行工作,自首批启动起约 88 小时后于 9 月 5 日达成结果,期间发送 270 万条消息、产生约 1300 亿输出 token,随后由 GPT-6 Astra 另花 17 小时完成 Lean 形式化与验证。但边界必须写清楚:它证明的是三维纳维–斯托克斯方程在一个全程施加的光滑外力项下会出现奇点,OpenAI 的口径是这确立了官方千禧奖表述中的陈述 C 和 D,而不是经典形式的那道题。此外,NYU 数学家 Tristan Buckmaster 就优先权提出质疑,OpenAI 否认,双方说法目前并不一致。

「解决了千禧难题」这个说法要减掉一项

传播里最容易丢失的是那个外力项。这次证明的对象,是一个从静止开始、全程被施加一个光滑外力的流体,结论是它会在有限时间内形成奇点。经典的千禧问题问的不是这个——它问的是无外力(或者说在标准设定下)的三维纳维–斯托克斯方程,解是否永远光滑地存在下去。 OpenAI 自己把话说得比多数转述更克制:它称这确立了官方表述里的陈述 C 和 D,并且明确表示不申领奖金。这个自我设限比结果本身更值得记——一家有强烈动机把成果说大的公司,主动划了边界。 克雷数学研究所的规则也决定了这件事没法快:奖金要在经同行评审发表、并经过两年社区验证之后才可能授出,历史上只授过一次(庞加莱猜想)。所以即便争议全部解决,时间表也是以年计的。

88 小时、1 万个 agent、1300 亿 token

方法侧的数字是这条新闻里最实的部分:近 1 万个 agent 并行推进,首批启动后约 88 小时得到结果,其间 270 万条消息、约 1300 亿输出 token;之后 GPT-6 Astra 又花 17 小时把证明写成 Lean 并通过验证。 值得注意的是这和上周 Anthropic 的费马大定理形式化不是一回事。那一次是把已有的人类证明翻译成机器可验证的形式——新的是验证。这一次声称的是新结果,Lean 只是最后的把关环节。两件事放在一起,大致划出了当下 AI 在数学上的两条战线:把旧结论变得可机器检查,和在有明确目标的问题上并行搜索新证明。

优先权争议没有定论

Buckmaster(NYU 数学教授)称 OpenAI 是在得知他与 Levent Alpöge(Anthropic 员工)正用某一特定方法攻关相关问题之后才启动的,并对私有的 Codex 使用材料是否起过作用提出疑问。 OpenAI 的说法是:9 月 1 日因听到一则传闻而开始,9 月 6 日完成证明与 Lean 验证后主动联系对方,提出同步发布并承认其优先权;研究员和 agent 在公开之前都没有看到对方的工作,也没有访问特定用户数据,但它不能排除来自产品使用的去标识化数据曾帮助改进模型;并称两份证明差别显著,在欧拉方程的情形下证的是不同结果(有外力与无外力之别)。Buckmaster 方面则称他们在 8 月 22 日已经有了欧拉方程的 Lean 验证证明。 还有观察者指出这项工作对 Córdoba 与 Martínez-Zoroa 早前研究存在明显的智识继承。这些分歧目前都没有第三方结论,写的时候只能把两边的说法并列。 同一周还有一件相关的事:在 771 位数学家联署公开信之后,OpenAI 退出了对 Caltech Mathathon 的赞助——联署者反对让本科生用 200 万美元的 AI 额度去攻公开问题,担心产生大量未经验证的「劣质数学」,并把核验成本转嫁给数学界。把这两件事放在一起,数学社区眼下要处理的不只是「AI 能不能证」,还有「谁来验、验的代价谁付」。

via: OpenAI《On the Navier–Stokes Millennium Prize Problem》Quanta Magazine 报道Scientific American 报道The Next Web 关于公开证明与不申领奖金的报道