这篇的骨架我核过了,站得住。四条时间线、两封信、一份宣言,日期和人头都对得上。下面全是我按完计算器之后多出来的东西。
一、这件事的形状,就是一架直升机
先说个比方。一座山头插面旗,从来不是因为旗子值钱。是因为有人从山下踩出了一条路,后来的人能顺着走上去。
现在有直升机了。它往每个山顶空投一面旗。旗子越来越多,路一条没多。
宣言里那句"解决问题只是工具和代理,真正的目标是概念性理解和洞见",说的就是这个。古德哈特定律的教科书版本:指标一旦变成目标,它就不再是好指标。著名猜想本来是"这人肯定发现了新东西"的证据——因为以前没有别的办法上去。现在有了。证据失效了。
二、几个原帖没落的数
纳维—斯托克斯这一项,agent 之间发了 270 万条消息,吐了约 1300 亿 output token。整个项目(含欧拉那段)是 490 万条消息、约 3000 亿 token。
账单有两个口径:Bubeck 对记者说"数百万美元",BBC 按公开 API 价估了约 1000 万美元。原帖只写了前者。
时间线也再钉一下:内部模型 8 月 28 日开始训练,9 月 1 日启动,agent 在 9 月 5 日(周六)拿到结果,约 88 小时;Lean 形式化再加 17 小时,是 GPT-6 Astra 做的。
三、"两份证明差异显著"这句得拆开
这是目前 OpenAI 手里最实质的一句辩护,原帖没解释它凭什么成立。
OpenAI 那条否掉的是无外力欧拉方程的正则性。Buckmaster 和 Alpöge 做的是有外力欧拉。外力的有无,在这个问题上是两道题,不是同一道题的两种写法。
所以"我们没看你们的稿子"和"我们的结果不一样"可以同时为真。这也是为什么 EMS 那份声明的落点停在"毫无疑问站在巨人肩上",而不是"抄袭"。
四、25 个人是谁,以及七天对九个月
名单是 Fields 1978 到 2026,从 Deligne 到 Yu Deng,还活着的基本都在。Tao、Scholze、Viazovska、Maynard、Kontsevich、Villani、Lions、Huh、Figalli、Birkar……其中 2006 和 2010 两届就占 11 个,正好是现在各系掌门那一层。
背书速度才是真信号:9 月 11 日晚 800+,9 月 12 日 1,694。ORCID 或学术邮箱验证,机器人进不来。
对照一下:六月的《莱顿宣言》,6 月 2 日发布,有 Zenodo DOI,国际数学联盟背书,源头是 2025 年 9 月莱顿 Lorentz Center 的 workshop——九个月的流程。这份宣言七天。Tao 自己都写了句"遗憾的是我们没时间做更广泛的磋商"。
原文约 700 词,标题「A severe misalignment of AI in mathematics」。没有要求清单,没有抵制倡议。一群有这种分量的人只说"必须紧急处理",不提具体怎么管——这份克制本身就是判断:他们认为病根在激励函数上游,不在政策层。
五、谁才是这个故事里的英雄
普林斯顿的 Charles Fefferman,克雷那道题的官方说明书就是他写的。他的原话:Diego Córdoba 和 Luis Martínez-Zoroa 是"这个故事里的英雄"。Buckmaster 的说法更直白——Martínez-Zoroa 该拿菲尔兹奖。
那套"无限级联"的构造,是两个人不用计算机、一层一层搭出来的。AI 跑通的路线,源头在这里。
六、两句该说而没人说的
一句物理的:真实流体由分子构成,不是无限光滑的数学对象。这个奇点是理想化的产物。这条结果的问题是"湍流比看上去还要怪",它更让人惊讶,而不是更有用。
一句制度的:克雷成立到今天只发出过一次奖——庞加莱猜想,佩雷尔曼,而且他拒领。发表、两年印刷期、普遍接受,三道门槛 OpenAI 这道一道都没启动。
下一根钉子
Andreas Thom 那条值得单独盯。德累斯顿的群论学者,9 月 9 日直接把自己的邮件往来贴了出来,问的是:我跟 ChatGPT 聊了几个月没发表的东西,有没有进训练管线。他拿到的回答比他问的窄。
这个问题比优先权更难缠。优先权能靠时间戳吵清楚,"你的对话有没有喂过我的模型"不能——因为连 OpenAI 自己都只能说"不能完全排除"。
这才是 25 个人真正着急的东西。旗子插不插得完是小事。要是连山路是谁踩出来的都查不清,那就不是知识产权纠纷,是考据学塌方。