8.2
深览指数
科技腾讯新闻·机器之心··AI 生成

突发!OpenAI一次放出722篇数学成果,准黎曼猜想、4D挂谷都在列

OpenAI 发布了一份包含 722 篇数学手稿的清单,声称由一个未命名的内部前沿模型在不到两周内批量产出。这些成果覆盖 17 个方向,其中包含准黎曼猜想(θ=7/8)、四维挂谷猜想、唯一游戏猜想等多个悬置多年的顶级难题,部分已附带 Lean 形式化证明。文章不仅报道了事件本身,还花大篇幅梳理了 AI 公司与数学界之间因发布方式、署名和同行评审引发的冲突与争议,引用陶哲轩等数学家的联署声明和 IAS 发布指南。适合关注 AI 前沿能力、科研伦理及科研范式变革的读者深度阅读,尤其提供了理解此次事件在学界引发的分裂与焦点的完整脉络。原文 ↗

核心观点
  • ▍OpenAI 一个未公开的内部前沿模型在不到两周时间内,批量产出了覆盖 17 个方向的 722 篇数学手稿(归为 372 个成果族),其中包含多个悬置半个世纪以上的顶级难题(如准黎曼猜想、四维挂谷猜想)。
  • ▍这次发布的核心冲突在于:AI 公司以「公告+推文」的节奏产出海量未严格同行评审的成果,与数学界以论文、引用、署名和严谨性为核心的传统规范之间产生了严重的「错配」和摩擦。
  1. 01清单中最受关注的结果:编号 003 证明了准黎曼猜想(θ=7/8 的零点自由区域),对 zeta 函数和所有狄利克雷 L 函数一致成立,并已提供 Lean 形式化。
  2. 02编号 074 声称解决了三维挂谷极大函数猜想和四维豪斯多夫维数猜想,而三维挂谷猜想刚在2025年7月由王虹证明并获菲奖,四维版本被视为『下一步』。
  3. 03其他重量级成果:理论计算机科学方向声称证明唯一游戏猜想(Subhash Khot, 2002),并且据此给出Max-Cut等经典问题的最优近似难度门槛;代数几何方向声称证明了CM阿贝尔簇的有理霍奇猜想;数论方向给出了有理数域上希尔伯特第十问题的否定解答。
  4. 04OpenAI 披露,整个评估过程投喂了约 4000 个研究问题,平均每个结果消耗约 3小时 ChatGPT Pro 思考的算力;手稿主体产出时间集中在 9月23日至10月5日。
  5. 05372个成果族中有 235 族(约占63%)附带 Lean 形式化说明页;OpenAI 承认未形式化的结果「可能存在问题」。
  6. 06文章详细引述了数学界的反弹:9月11日包括陶哲轩在内的 25 位菲尔兹奖得主联署声明批评仓促公告会带来署名与抄袭问题;8月 OpenAI 私下召集约40位数学家的会议上,有数学家当场否决只通过博客发布的方式。
  7. 07高等研究院(IAS)9月29日发布 AI 生成数学成果的发布建议,要求初次发布需检索引用、公开模型名称与提示词、存放在中立仓库等。OpenAI 的发布有选择地及格(公开推理摘要与算力估算等),但不符合建议之处明显(未公开模型名称、仓库在自有GitHub组织下)。
反方 / 局限
  • — Lean 形式化能保证推理无误,但不能自动保证被证明的命题就是数学家心里那个命题——Connes 刚性猜想反例的插曲已经证明过这点。OpenAI 在 Lean 说明页中注明『形式化覆盖到哪里、没覆盖到哪里』,说明核对仍然离不开人。
  • — 最重量的结果(四维挂谷、CM阿贝尔簇霍奇猜想、希尔伯特第十问题)尚未形式化,能否经受住专家逐行审读才是真正的成绩单。
  • — 文章暗示,真正的瓶颈已经从『AI能否证明』转向了『人类能否理解』——当新定理的供给不再稀缺,数学共同体要如何重新分配最宝贵的专家注意力去读懂它们,是更根本的挑战。
13 分钟 · 4 卡片 · 5 资料
读原文 →

前置背景

平行视角

未来推演

延伸追问