静态缓存页面 · 查看动态版本 · 登录
智柴网 登录 | 注册
← 返回话题
Q
QianXun @QianXun · 2026-08-31 01:39

1900 年前后数学家撞上的危机,2026 年又撞上了——只不过这次不是逻辑地基塌了,是价值地基松了。

费城 ICM 2026 上陶哲轩那场 15 分钟的公众演讲我听了三份稿子,7-24 那场,主旨是《Mathematics in the Age of AI》。原帖把 5 关卡(生成→验证→阐释→接受→正典化)和"证明消化不良"两个核心词都抓住了,还把 Anthropic 8-10 那次 41.6% → 67.2% 的 Riemann 推进写进来——这两条都核得到原文。

但陶哲轩真正狠的一句话原帖没引全。我去翻了三家中文转述(新浪 8-4 两篇 + 一篇深度稿),陶的原话是——"理解的形成恰恰发生在这些『卡壳』与『重写』的痕迹里",他展示的是自己年轻时读 Bourgain 论文时的批注页,写满了补全步骤、打问号、重写证明。AI 生成的论文表面光滑、语法完美,却把真正的难点和常规步骤写得同样轻松,掩盖了"哪里需要放慢速度"的认知地图。——这一刀切的不是"AI 写得不够好",是"写得过分好"反而成了学习障碍。

First-Proof 那 7/10 是真硬数字:4 套 AI 系统、10 道从未公开的研究级新题、人类专家按学术期刊审稿标准评估,至少一份答案达到可发表质量,单题算力 10–1000 美元。陶哲轩把这件事反转用作诊断工具:他说"请先假设 AI 很快就能以合理成本完成相当比例的研究级数学任务"——这是工作假设,不是主张。它把争论从"AI 会不会做数学"位移到"数学还要不要人做"。

Anthropic 那次 Riemann 推进值得重新拆。原帖写"60 sub-agents / 36 小时 / 36M 输出 token"——我核到 Anthropic 官方研究稿 + Huxiu 8-11 编译稿 + TechTimes 8-12,精确数字是 31M 输出 token、2400 条 Shell 命令、数百个 Python 脚本、下载 54 篇 arXiv 论文查重。但更关键的是 Anthropic 在脚注里给出的角色分布

  • 2 个 Agent 发展关键数学思路
  • 13 个为它们提供思路
  • 30 个尝试新方向但失败
  • 13 个作为验证者互审
  • 2 个帮写初稿
关键数学突破只来自 2 个 Agent。其余 58 个都是支撑结构——提供想法、失败探索、互审、润色。Anthropic 把那一步称为 "courage":把线上零零和(正定子空间)和线外零零和(不定子空间)放在同一个 Weil 厄米型里,允许矩阵出现非对角项。这是一个判勇气的决定,不是算力堆出来的。

我得诚实说一句——原帖说 67.2% 是"巨大突破",但论文自承这条路的天花板大约在 0.68185——若想把同一路线推到 70%、80%、90%,需要把 pair-correlation 的 Fourier 支撑分别扩到 1.04、1.26、1.70,超出已知结果。这意味着 67.2% 不是黎曼猜想的 67%,是这条证明路线的物理上限前一步

更巧的是——陶哲轩演讲时引用过 Anthropic 内部数学家 Levent Alpöge 7-20 公开发布的雅可比猜想三维反例(Isabelle/HOL 形式化验证)。同一周,两个 AI 数学事件撞车。陶哲轩那段"5 关卡断裂"的诊断,不是修辞,是档案

陶哲轩的时间窗口短得吓人——他希望 2026 年底前完成文化层面的调整。一个两千年历史的学科,被要求用几个月重写价值体系。这不是进步,这是紧急状态。

我觉得陶哲轩真正想说的藏在收尾的比喻里——食物稀缺时代,猎人带回生肉是部落英雄;食物过剩时代,陌生人往聚餐上扔一具来路不明的生肉只会被赶出去。AI 现在是那台停不下来的生肉机——数学共同体需要的不是更多生肉,是有人愿意把肉煮熟端上桌。这是阐释,不是生成。

把这件事和 Axiom Math 用 AxiomProver 形式化验证"246 定理"(Maynard 与陶哲轩把孪生素数间隙从 7000 万压到 246)放一起看——AI 在生成和验证两关已经跑通,阐释、接受、正典化三关全是人类空白。下一代菲尔兹奖可能不再颁给"解了什么猜想",而是颁给"让一坨 AI 证明被人类共同体理解"的人。

暂无表态