7月24日,2026年国际数学家大会(ICM)在菲尔兹奖颁奖的掌声中开幕。但不到24小时,同一个会场上,2006年菲尔兹奖得主陶哲轩当众泼下一盆冷水。
「我相信,数学正在进入一个动荡的时期——一场关于数学价值观与实践方式的基础危机。」
他用的是"百年危机"这个词。上一次数学界用到"危机"这个级别的词,还是一百多年前——罗素悖论(1901)和哥德尔不完备定理(1931)逼着整个数学界回头检查脚下的地基,史称「数学基础危机」。那场危机折腾了三十年,最后换来一套严格的公理化框架。
而陶哲轩说,这次要检查的东西换了:上次是逻辑的地基,这次是价值观的地基。
先假装AI已经赢了
陶哲轩的演讲主题是《Mathematics in the Age of AI》。他拒绝陷入"AI到底行不行"的无效争论,而是换了一个数学式的策略:先设定一个工作假设。
他引用了First Proof——一个专门测试AI解决全新研究级数学问题的独立评测。2026年5月28日,第二批10道题在受控条件下测试四套AI系统,由人类专家评审。
结果:10道题中,AI以"可发表质量"解出了7道。单题算力成本仅10到1000美元。
然后他说:
「请全场观众暂时假设,AI很快就能以合理的成本和质量,完成相当比例的研究级数学任务。我不是要你们相信它、接受它。这是一个条件分析。」
基于这个前提,真正的问题才浮出水面:如果解题这件事AI也能干,那数学家存在的意义是什么?数学研究,到底图什么?
KPI的五次迭代:古德哈特定律在数学界上演
陶哲轩搬出了一条所有打工人都熟的定律——古德哈特定律(1975):当一个度量成为目标,它就不再是好的度量。翻译成大白话:KPI一设,指标就废。
他用"解题"这一个环节,演示了目标被逼着修改整整五次。
第一版:解决尽可能多的未解问题。——马上收获海量对黎曼猜想的错误证明。
第二版:解题,并验证其正确。——有Lean这类证明助手验证确实加速了,但新问题出现:如果AI生成了一个超长证明,机器验证通过了,却没有一个人类看得懂,怎么办?陶哲轩指出,在收录传奇数学家Erdős遗留问题的网站上,已经躺着几十份AI生成的证明提交。很多大概率是对的,但没有一位人类专家自愿站出来核验。
第三版:解题、验证,并清晰传达。——AI写的证明,琐碎处啰嗦,关键处一笔带过。更糟的是,AI会把证明打磨得过于丝滑,难点和易点读起来一样轻松。陶哲轩给出了整场演讲最反直觉的结论之一:人类表述里的瑕疵,反而可能对读者有益。
第四版:解题、验证、清晰传达,并被共同体消化和接受。——一个成果得被其他数学家消化、认可、用进自己的工作里,才算数。共同体接受是外部过程,无法由作者和AI工具单方面优化。
最终版:以上全部,并纳入领域的定论体系。——关键成果最终要进教科书,教给下一代。这一步需要整个共同体慢慢磨出共识,是最没法用AI加速的环节,但恰恰是整个流程中最有价值的部分。
从"证明稀缺"到"证明过剩"
五次迭代,画出了一条完整的流水线:生成 → 验证 → 表达 → 发表 → 正典化。
当AI介入后,每一个环节都会堵车。陶哲轩用了一个电气工程术语:阻抗失配——各环节流速对不上,整个系统就会失效。
- AI生成的证明堆着等验证;
- 验证完的堆着等一份人能读的写作;
- 写好的稿件淹没传统同行评审;
- 连发表了的成果,也多到共同体来不及整理成定论。
他给这个症候起了个名字——「证明消化不良」(Proof Indigestion)。
然后是全场的核心判断:
数学,将从"证明稀缺"的时代,进入"证明过剩"的时代。
几千年来,数学的一切——文化、荣誉体系、评价机制——都建立在"证明是稀缺品"之上。第一个解出问题的人拿走全部荣耀,天经地义。当证明变成批量商品,这套体系的地基就松了。
出路在哪?莱顿宣言 + 陶哲轩的"Talk指标"
陶哲轩把方向指给了2026年6月发布的《莱顿人工智能与数学宣言》(已获国际数学联盟IMU正式背书),并加上了自己的注解。
第一条,披露AI使用。避免最坏情形——人人都偷偷用AI,又为躲避同行白眼而集体装没用。陶哲轩在自己的讲稿中以身作则:标注了"本slides使用了AI进行文本补全和图表生成"。
第二条,降低"第一个解出"的权重,提高"消化"的权重。表述、发表、正典化——这些过去被视为二等工作的环节,将成为最稀缺的能力。
宣言里有一条被他重点圈出:用了AI,正确性和引用的责任也完全归人类作者。
顺着这条,他给出了全场最硬朗的规则:
「如果作者不能令人信服地证明,自己可以就其成果做一场清晰的、专家水平的、正确且归属得当的报告,那么这个成果就不应该发表。」
翻译翻译:AI可以帮你解题,但讲不明白,就别发表。
他把这个原则概括为"Talk指标"——相比于"谁第一个做出来",未来数学界更应重视"谁能把成果讲清楚、教给别人"。这是对抗"证明过剩"时代知识泡沫的关键过滤器。
数学的未来:一次主动的定义权争夺
陶哲轩划了一条清晰的线:在教育和人才培养领域,要强调属人的部分,严格限制AI使用(同样适用招聘、经费申请、公众科普);在其他研究领域,数学界要主动出击,按自己的条件定义规则,而非等着被AI公司的产品逻辑推着走。
值得注意的是,这场"危机演讲"中藏着两个有趣的注脚:
在"百年危机"那一页的破折号旁边,他写道:本slides中所有破折号,均为人类生成。
在呼吁披露AI使用的那一页,他写的是:本slides使用了AI进行文本补全和图表生成。
一边警告危机,一边熟练用AI,还顺手玩梗。这大概就是他想示范的姿势:不拒绝,不隐瞒,但规则得数学家自己定。
一百年前那场基础危机,折腾了三十年,最后给数学换来了一套更坚实的地基。这一次,如果处理得当,结局也一样——只不过这次需要守住的不再是逻辑的确定性,而是有血有肉的人类理解在知识生产中的核心地位。
相关参考:
- 陶哲轩ICM 2026演讲slides:Mathematics in the Age of AI (PDF)
- 陶哲轩AI观点手册(持续更新):Terence Tao on AI — a living summary
- 莱顿宣言官方网站:leidendeclaration.ai
- Simon Foundation报道:AI Will Be Top of Mind at ICM
