澎湃新闻
26-09-09 10:52 微博认证:澎湃新闻官方微博

【新闻蒸馏器丨OpenAI:#AI模型已破解数学界千禧年难题之一#】一句话读懂

OpenAI于9月8日宣布,其一款尚未公开发布的内部模型解决了纳维-斯托克斯方程的存在性和光滑性问题,这是克雷数学研究所(Clay Mathematics Institute)2000年设立的七大“千禧年难题”之一。#OpenAI宣布攻克千禧年难题#

为什么重要

如果被数学界认可,这将是继2010年佩雷尔曼证明“庞加莱猜想”后,七个“千禧年难题”中第二个宣告解决的问题,也是首次由AI系统主导攻克此类顶级数学难题。OpenAI首席科学家帕乔基说,一个月前他们完全没料到会讨论一个“千禧年难题”,认为这体现了AI能力的跃升速度。部分数学家在兴奋之余也产生了忧虑:如果最难的问题可以在人类很少参与的情况下被AI解决,人类对该领域的理解本身是否会被削弱。

幕后发生了什么

♦“千禧年难题”的由来

克雷数学研究所由商人兰登·克雷出资设立,2000年选出七道数学难题,每道悬赏100万美元,用以推动新千年的数学进展。“庞加莱猜想”证明者、俄罗斯数学家格里戈里·佩雷尔曼2010年获奖后拒绝领取奖金。

♦纳维-斯托克斯方程是什么?

这组方程由克劳德-路易·纳维和乔治·加布里埃尔·斯托克斯于19世纪提出,描述水、空气等流体的运动规律,广泛用于天气预测、飞机设计、血流建模等领域。

克雷数学研究所提出的“纳维-斯托克斯方程存在性与光滑性问题”,关注的是三维不可压缩流体的解能否始终存在并保持光滑。简单来说,数学家希望证明:如果流体一开始处于足够平滑的状态,那么随着时间推移,方程的解是否会一直保持平滑;还是可能在某些极端情形下“失控”,即所谓的“有限时间爆破”。

♦AI攻克多个数学难题

过去一年,AI系统的数学能力经历了从在国际数学奥林匹克竞赛中拿到银牌、金牌,到今年1月与初创公司Harmonic合作解出一道“埃尔德什问题”,再到此次攻克“千禧年难题”的快速跃升。

据报道,这一过程依赖“强化学习”技术,即AI通过海量数学题的试错训练判断对错,并使用一种名为Lean的编程语言生成、验证可被严格核查的数学证明。

有何新进展

♦解题过程

OpenAI介绍,其团队9月1日在听闻Anthropic已解决两个“千禧年难题”的传闻后,将一款尚未公开、能力“显著强于”上周刚发布的GPT-6 Astra的内部模型,投放到六道悬而未决的难题上。传闻与Anthropic研究员阿尔珀格、纽约大学教授巴克马斯特正在进行的相关流体力学研究有关。

约50小时后,模型在与纳维-斯托克斯相关的一道子问题上取得关键进展,团队随即将全部算力集中于此,AI智能体数量从约100个扩充至最多1万个,累计耗时约88小时,共发送270万条消息、耗用1300亿输出token(约合100万本书体量)。最终结果于5日完成、6日通过计算机验证。结果令OpenAI内部最严谨的研究者也感到意外。

OpenAI称其证明显示纳维-斯托克斯方程的解会在有限时间内发生“爆破”。

♦AI能力突破

OpenAI称,在其内部的数学题基准测试中,已发布的GPT-6 Astra能解出约10%的题目,而这款未发布的新模型解出比例接近50%。

♦谁会领取奖金

OpenAI表示不打算申领这道题对应的100万美元奖金,称发布结果意在展示其AI模型的能力进展。克雷数学研究所所长马丁·布里奇森回应称,正式认定尚需时日。“评审过程本就有意放缓,我们会确保它绝对严谨”。

♦数据和署名争议

巴克马斯特8日凌晨(早于OpenAI公布)发表了他与阿尔珀格关于相关流体力学问题的研究声明,即欧拉方程(纳维-斯托克斯的简化版)的“有限时间爆破”证明,称其工作使用了Anthropic与OpenAI两家的模型,并质疑OpenAI新模型是否基于这些交流会话训练或曾接触相关内容。

OpenAI表示,其代理与研究人员在相关未发表研究公开前均未见过,同时承认,用户使用其产品的数据不太可能有助于改进模型,但也不能完全排除这种可能性。

据巴克马斯特披露,9月6日两次通话中,OpenAI数学团队负责人布贝克曾提出两种署名和发布方案:巴克马斯特与阿尔珀格先发表其欧拉方程成果,OpenAI次日发布完整证明并致谢二人系“最接近答案的人类”;或巴克马斯特单独发表自己的研究并宣称OpenAI模型“也”解出了该问题,但条件是将Anthropic的阿尔珀格从署名中移除。布贝克对这一通话内容表示否认。详情→http://t.cn/AX0u6XzX