一封罕见的联名信
2026年9月11日,邓煜、陶哲轩等25位菲尔兹奖得主联合发布声明《人工智能在数学中的严重错位》。菲尔兹奖是数学界的最高荣誉,25位得主集体就一个技术事件发声,这在历史上都极为罕见。
他们反对的核心是一件事:把"AI解出数学难题"当成衡量AI进步的基准测试,并以此抢占学术优先权与公众叙事。
数据来源:2026年9月11日《人工智能在数学中的严重错位》联名声明
导火索:88小时与Navier-Stokes
事件的引信,是9月8日OpenAI宣布:其模型在88小时内求解了Navier-Stokes方程相关的开放问题。
Navier-Stokes是流体力学的基石方程,千禧年七大数学难题之一,其正则性问题悬而未决数百年。一个模型在88小时内"解出"它,无论是营销上还是学术上,都是核弹级的新闻。
但纽约大学数学家Tristan Buckmaster随后站出来提出了尖锐质疑:OpenAI在知晓学界真实研究进展的情况下抢先发布了结果。 换句话说,数学家们担心的不是AI不能做数学,而是工业界用"题库式刷题"的叙事,偷换了数学研究本身的创造过程。
“基准测试"误解了数学在做什么
联名信的深层观点,值得仔细读。数学家们认为,AI把数学当成一套可以被刷题、被benchmark、被SOTA刷新的题目集,这严重错位了数学的本质:
- 数学的核心不是"解出标准答案”,而是提出好问题、建立新概念、构造新结构;
- 一个开放问题之所以重要,不在于它有没有"解",而在于它逼迫人类发明了什么工具、打开了什么方向;
- 把一次"求解"包装成里程碑,会误导公众与资本,也会扭曲学术评价体系。
这是一场关于**“什么才算数学进步”**的定义权之争。
当工业速度撞上学术伦理
这件事的张力在于两种文化的碰撞:
- AI工业界:追求速度、可复现、可演示的"解题能力",习惯以榜单和数据说话;
- 数学界:讲究优先权、证明的严谨性、思想的传承,节奏慢但要求绝对诚实。
OpenAI被指责的关键,不是"用AI做数学",而是在知晓他人工作的时间点上抢先宣布——这在学术伦理上触碰了红线。当一家拥有顶级算力的公司,可以在几小时内"重算"一个学者数年才推进的问题,学者的研究优先权该如何保护?这是一个全新的制度问题。
行业影响
guijiagi.com认为,这封联名信的意义远超数学圈。它揭示了AI时代一个普遍困境:当AI能力可以被快速复现,传统学术圈赖以运转的"优先权"与" credit"体系正在被冲击。
它也提醒AI公司:能用算力刷出一道题,不等于理解了一门学问;能宣布"解决",不等于完成了人类共同体意义上的贡献。真正的合作,应当是AI作为数学家的工具,而不是以"碾压"的姿态取代并抢占叙事。AI与数学的健康关系,需要在能力狂奔与学术伦理之间,重新找到那个平衡点。