8.2
深览指数
科技腾讯新闻·AI寒武纪··AI 生成

陶哲轩ICM 2026:数学界迎来“百年新危机”,AI狂飙逼迫全行业重写游戏规则

陶哲轩在ICM 2026演讲中提出,数学界正面临一场类似20世纪初基础危机的“元危机”,核心是AI颠覆了数学研究的价值与实践方式。他设置了“AI能力猜想”作为讨论前提,并基于First Proof挑战赛(七道题被AI攻克)等证据,系统推演了从“证明稀缺”到“证明消化不良”的链条:AI生成大量正确但无人能验证、无人愿消化的证明将堵塞同行评审与知识经典化体系。他引用《莱顿人工智能与数学宣言》给出初步建议,核心是呼吁共同体重新定义数学的真正目标——不仅是解题,更包括阐述、教育与知识传承。适合关注AI对基础学科研究范式冲击的科技从业者、学术管理者与数学家阅读。原文 ↗

核心观点
  • 数学界正经历一场类似20世纪初基础危机的“元危机”,AI将迫使数学共同体重新审视研究的目标、价值和工作方式,否则将面临“证明消化不良”——AI生成大量正确但无人能验证、无人愿消化的证明,堵塞整个知识生产链条。
  • 问题的核心是“共同体应对问题”:如何应对AI能力?这属于元数学范畴,涉及政治、伦理和文化,需要整个共同体回答,而非陶哲轩一人能给出答案。
  1. 01陶哲轩定义了“AI能力猜想”作为讨论前提,其强弱版本取决于“在未来时间点,AI工具以何种花费、监督水平完成多大比例的研究级数学任务”。如果最强的版本成立,现有的数学文化和工作方式将难以维持。
  2. 02First Proof挑战赛(2026年5月28日,第二批10道题)结果:7道题被AI团队做到可发表水准,每道题算力花费10-1000美元。这是目前支持AI能力猜想最受控的公开证据。
  3. 03基于“AI能力猜想成立”的工作假设,陶哲轩推演了从“证明生成→验证→阐述→发表→消化→经典化”的完整链条,并指出每个环节都可能出现阻塞:AI生成的证明堆积无人验证、验证后无人撰写可理解的阐述、发表后数量压垮同行评审、评审后共同体无法消化为经典理论。
  4. 04现实案例:埃尔德什问题网站已堆积几十份AI生成的证明提交,其中不少大概率正确,但无人类专家愿意验证或背书,提交者自己也表示无力验证。
  5. 05陶哲轩引用瑟斯顿(1994年)观点:数学工作的真正成功标准是“帮助人们更清楚、有效地理解和思考数学”,而非完成生产指标。一份证明即使正确、易读,若不能被共同体接受和消化,贡献也有限。
  6. 06陶哲轩指出AI在证明阐述上的问题:文本虽完美无瑕,但常对琐碎细节着墨过多,对真正新颖、有洞察的部分轻描淡写,且缺乏与已有文献的联系和高层概览。
  7. 07《莱顿人工智能与数学宣言》(2026年6月2日发布)给出五条核心建议:公开工具使用情况、支持审稿需求、保留正确性责任、认真对待署名和致谢、参与公共讨论。陶哲轩补充了个人判断标准:若作者无法就自己的结果做一场清晰、专家水准的报告,该结果不应发表。
反方 / 局限
  • 陶哲轩明确承认,整个演讲建立在一个“工作假设”之上(AI能力猜想成立),并强调该假设是否成真与后续分析是两条独立线索。这暗示如果AI能力猜想的弱版本为假,整个危机叙事将失去基础。
  • AI工具在数学上的成功本身建立在人类数学家几百年来辛苦搭建的经典理论之上,即AI是“站在巨人肩膀上”,这限制了它产生真正原创的、颠覆性洞见的可能性。
  • 陶哲轩指出,解题只是数学工作的一部分,理论建设是另一个同样重要的方面,且AI对教学、招生、基金申请、公众科普等方面的影响未在演讲中展开,这些方向可能呈现与解题领域完全不同的图景。
14 分钟 · 5 卡片 · 15 资料
读原文 →

概念锚点

前置背景

平行视角

未来推演

延伸追问