8.1
深览指数
科技腾讯新闻·量子位··AI 生成

陶哲轩在菲尔兹颁奖现场:数学迎来百年新危机

陶哲轩在2026年ICM大会演讲中提出,AI将使数学从「证明稀缺」进入「证明过剩」时代,引发一场关于数学价值观与实践方式的「百年危机」。他引用First Proof评测数据(AI以可发表质量解出10道中的7道研究级数学题),并假设AI很快能完成相当比例的研究级任务,以此推演数学目标体系在古德哈特定律下的崩溃过程。演讲核心结论是:人类数学家的稀缺能力将从「解题」转向「消化」——表述、验证、发表、正典化;并给出硬性标准:讲不明白就别发表。适合关注AI对基础科研影响、科研评价体系变革的读者阅读。原文 ↗

核心观点
  • 数学正在从「证明稀缺」时代进入「证明过剩」时代,AI将引发一场关于数学价值观与实践方式的基础危机,而非逻辑地基的危机。
  • AI可以解题,但讲不明白就别发表——如果作者不能令人信服地证明自己可以就其成果做一场清晰的、专家水平的报告,该成果不应发表。
  1. 01First Proof评测显示,2025年5月28日,AI在受控条件下以「可发表质量」解出了10道全新研究级数学问题中的7道,单题算力成本10-1000美元。
  2. 02古德哈特定律:当一个度量成为目标,它就不再是好的度量。陶哲轩认为生成式AI的「不接地」性质与AI公司的商业激励,使AI工具在该定律面前格外脆弱。
  3. 03Erdős遗留问题网站上已躺着几十份AI生成的证明提交,很多大概率正确,但没有人类专家自愿核验;部分提交者承认自己「没这个资格验」。
  4. 04AI写作的拼写、语法、排版近乎完美,但琐碎处啰嗦、关键处一笔带过,且将证明打磨得过于丝滑,读者难以真正理解。
  5. 05陶哲轩展示1991年Bourgain论文上自己手写的「I hate Jean Bourgain」批注,说明看不懂、被卡住、边骂边啃的过程本身就是数学传承的一部分。
  6. 06陶哲轩用电气工程术语「阻抗失配」描述AI流程:生成的证明堆着等验证、验证完的堆着等人类写作、写好的稿件淹没同行评审、发表的成果来不及正典化。
  7. 07陶哲轩引用《莱顿宣言》建议:降低「第一个解出」的权重,提高「消化」(表述、发表、正典化)的权重。
反方 / 局限
  • 陶哲轩本人也承认,某些「消化不良」症状在AI到来之前就已存在,暗示问题并非完全由AI引发,AI只是加速了已有矛盾。
  • 防止AI最坏情形的思路——正方观点是「披露AI使用」,但这一方案依赖共同体自愿遵守,缺乏强制力,且可能面临「集体装没用」的囚徒困境。
12 分钟 · 4 卡片 · 11 资料
读原文 →

前置背景

平行视角

未来推演

延伸追问