AI公司解决数学难题引发学术争议

2026年9月11日,包括陶哲轩、邓煜、皮埃尔·德利涅(Pierre Deligne)、吴宝珠(Ngô Bảo Châu)在内的25位菲尔兹奖得主联合签署并发表了一封名为《人工智能在数学领域的严重错位》(A Severe Misalignment of AI in Mathematics)的公开信。该公开信批评AI公司将“解决著名数学难题”作为衡量模型能力的基准,认为这种做法是对数学这门科学和数学共同体的伤害。

纳维-斯托克斯方程解题风波

此次风波的导火索是OpenAI于9月8日的发布。OpenAI宣布其内部模型通过约1万个Agent并发,在耗时88小时后解决了克雷数学研究所选出的七大“千禧年大奖难题”之一——纳维-斯托克斯方程问题。OpenAI称该模型证明了在光滑外力作用下,一类起初完全静止的正常流体会在有限时间内速度升至无穷大(即“爆破”)。该公司随后公布了Lean形式化验证,并公开宣布拒领100万美元的千禧年大奖。

据OpenAI称,完成解题的模型始于8月28日训练,能力显著强于GPT-6 Astra,且整轮攻坚消耗了数百万美元级算力。然而,在公告发布前数小时,纽约大学数学家Tristan Buckmaster与Anthropic数学家Levent Alpöge发表了同一问题的突破,并指责OpenAI“抢跑”。

数学界的担忧与核心诉求

数学家们表达愤怒的核心在于AI公司将数学难题转化为基准测试和公关素材。公开信指出,这种仓促公布结果的方式会挤占撰写论文、提炼新方法以及引用在先工作的时间。虽然签署者承认AI具有加速真正数学研究的潜力,但反对当前的运作模式。

目前,AI公司在数学难题领域的竞争态势明显。除纳维-斯托克斯方程外,OpenAI被曝在霍奇猜想上取得实质性进展,并尝试解决黎曼猜想和P与NP问题。据传OpenAI与Anthropic正竞速冲锋BSD猜想。一份流传的“千禧难题基准测试”图表显示,OpenAI内部未发布系统得分为2分,Anthropic内部未发布模型为1分,人类基线为1分,而Meta、DeepMind、xAI等公开模型均为0分。