「40 位顶尖数学家闭门开会,问了一个没人敢回答的问题」——OpenAI 秘密峰会与数学界的『价值危机』
华盛顿邮报 2026-08-19 报道了一件被中文媒体放大的事:OpenAI 召集了约 40 位顶尖数学家开了一场闭门峰会,议题只有一个——「当 AI 能做数学研究时,人类数学家还剩什么?」会议由 OpenAI 研究员 Bubeck 主持,与会者包括菲尔兹奖得主、加州大学伯克利分校助理教授 Jacob Tsimerman、哈佛数学家 Melanie Matchett Wood、德国数学家 Andreas Thom 等。会议没有达成共识,但它在数学界内部引发了一场「价值危机」式的震动。
一、四种可能的未来:Bubeck 的开放性提问
会议组织者 Bubeck 在会后描述了四种可能的未来,没有给出答案,但每个答案都指向一个完全不同的数学学科未来:
1. 数学变得像软件工程:AI 帮助数百人协同攻克同一个问题; 2. 数学变得像物理学:靠堆算力和 AI 模型替代粒子加速器,直接「算」出新定理; 3. 数学变成博物馆策展:AI 负责产出,人类负责挑选和解读; 4. 数学家集体转型做 AI 安全。
Bubeck 自己说了一句非常清醒的话:「我们必须把人、把数学家放在第一位。数学只有在数学家从中学到东西的时候才有意义。」但他也坦承:40 位与会者没有达成共识。
二、AI 能证题,但「讲不清自己怎么证的」
哈佛大学数学家 Melanie Matchett Wood 帮 OpenAI 的单位距离猜想结果写了人类版本的证明。她的观察非常尖锐:「顶级 AI 模型在解释上有一个共同毛病——简单的部分说一大堆,难的部分一笔带过。」
她进一步指出:「顶级 AI 模型还做不到识别论证中真正困难的部分,并把它讲清楚。」这句话的杀伤力在于:数学界的核心价值是「理解结果,不只是证明结果」——一个没有被理解的证明,不会成为文献的一部分。
德国数学家 Andreas Thom 给出了一个更精确的区分。OpenAI 公布的 10 项新成果中有一项关于「非 sofic 群」的新构造,填补了 Thom 与合作者 Gábor Kun 在 2016 年和 2019 年两篇论文之间的空白。两人随后发表了后续论文,对 AI 的发现做了简化和拓展。Thom 说:「AI 在以非常聪明、有分量的方式解决问题。但新概念是人类参与证明过程之后才浮现的,目前还不是 AI 自己做到的。」
三、Tsimerman 选择做 AI 安全:一个标志性事件
Tsimerman 是 2022 年菲尔兹奖得主,也是继丘成桐之后第二位获此荣誉的华裔数学家(注意:Tsimerman 是加拿大籍,但作为北美数学界华裔代表具有标志性意义)。他尚未正式入职 OpenAI,但选择去做 AI 安全研究——这本身就是「数学家处境的一个缩影」。
一位菲尔兹奖得主选择去 AI 公司做安全研究,这件事本身就是数学界「价值危机」的具象化:当 AI 能证明的定理越来越多,数学家开始怀疑「我接下来做的工作还有没有不可替代性」,于是选择把精力投入到「确保 AI 不被滥用」这条更迫切的战线上。
四、与近一周数学×AI 主线的呼应
把这件事放进 8 月底数学×AI 主线看:
- 8/23 陶哲轩「消化」AI 证明 + Palomar 登记库:森多夫 9 万行 Lean → 1.5 万行,四时点归属权(已发);
- 8/23 OpenAI Astra 8/1 用 Lean 4 写完 10 道开放数学,8/7 因「关键级」被安全锁定(已发);
- 8/22 Axiom Math(25 岁广州女孩创立)完成 246 素数间隙定理 Lean 4 形式化验证(已发);
- 8/23 Talagrand 凸性猜想 31 年悬案 + 人机协作(已发);
- 8/24 这次 40 位数学家闭门会议(本次)。
五、对数学教育和科研评价体系的隐喻
这件事更深一层的隐喻是对数学教育和科研评价体系的冲击:
- 当 AI 可以量产定理证明,「证明了多少定理」作为学术评价指标还能不能继续?
- 当 AI 可以在几小时里跑完一个反例搜索,「发现反例」还能不能算原创贡献?
- 当 AI 可以快速生成形式化证明,「形式化能力」还算不算数学家的核心素养?
六、对中国数学界的启示
中国数学界过去几年在 AI4S(同周 8/24 中国科学智能大会上,「验证成为核心瓶颈」被多位院士提及)、数学×AI 工具(陶哲轩主导的 Palomar 中继站、Lean 4 形式化)上有持续布局。但这次闭门峰会的隐喻在于:
- 不能只关注「AI 能加速证明」,还要关注「数学家还剩什么价值」;
- 不能只关注工具,还要关注制度——菲尔兹奖、ICM 邀请报告、数学年刊等评价体系如何回应 AI 时代的「价值危机」;
- 中国数学界的优势在于「人多+题量大」,但劣势在于「原创概念相对少」——AI 时代这恰好是最危险的组合,因为 AI 会快速抹平「题量大」的优势,但很难替代「原创概念」的核心地位。