跳到正文
FunCoding

搜索

搜索文档、文章、Skill 和 MCP

返回热点

OpenAI 公开内部模型数学成果与 Lean 证明

持续报道中卡15 个来源21 篇报道更新于 2026年10月10日 11:04

事件综述

OpenAI 于 10 月 7 日在 GitHub 发布 openai/math 仓库,公开由未发布的内部前沿模型产出的数学成果:722 份手稿,归为 372 个结果族,涵盖数论、代数几何、偏微分方程等方向。OpenAI 称许多证明已用 Lean 形式化以便计算机验证,并附论文修订与引用协议;发布前咨询了普林斯顿高等研究院的数学与人工智能独立咨询组,并按其建议和公开推荐决定发布方式。

据 The Verge 和 IT之家报道,独立咨询组织 AGMAI 称这批成果包含对数百个长期公开数学问题的解答。OpenAI 称绝大多数结果由同一流程、用未发布内部模型完成,平均每个结果约相当于 3 小时 ChatGPT Pro 思考算力,评估期间模型共被提出约 4,000 个问题。例外包括黎曼 zeta 函数零点自由区域和 CM 阿贝尔簇上 Hodge 猜想证明的相关工作,其中 Re(s) > 11/12 零点自由区域的文稿经人工编辑以提升可读性。

Rohan Paul 提到,部分结果尚无 Lean 形式化,可能存在问题,仓库将持续更新;其称矩阵乘法证明把两个 n×n 矩阵乘法的已证明成本从 AlphaEvolve 今年 8 月创下的约 n^2.371177 降至约 n^2.25,但这属理论界,尚未提供可用于真实 GPU 负载的更快例程。The Verge 后续报道称,数学家消化这批结果可能需要数年,且 OpenAI 称 719 份手稿中仅约 300 项顶层结果(约 42%)已在 Lean 中形式化,OpenAI 未披露所用模型、提示词及模型尝试的完整问题集。此前 9 月 29 日,agmai.org 发布《Responsible Release of AI-Generated Mathematics》,针对 AI 实验室发布数学成果提出建议,并明确反对在闭源模型上测试高难度数学问题。

最新进展OpenAI 公布 700 多份数学研究文稿,数学界反应分化并担忧合作传统受损

综述由 AIHOT 用 AI 根据各家报道生成,细节以原文为准。

报道时间线

10月11日周日

  1. Azeem Azhar:Exponential View

    AI 与数学 2.0、巴基斯坦的太阳能对冲,以及谁在掌控算力

    OpenAI 发布含数百份数学手稿与证明的 repo 后,一个名为 Association for Human Mathematics 的新组织呼吁数学家停止与其合作,Terence Tao 则提出"Math 2.0"应弱化解题优先、转向阐述与社区建设。

10月10日周六

  1. The Decoder:AI News

    OpenAI 一次性发布 700 多份数学手稿,数学家们反应震惊与反感

    OpenAI 于 2026 年 10 月 6 日在 GitHub 一次性发布 700 多份手稿,声称解决数百个未解数学问题,数学博客 Proofs and Prompts 收集了 100 多位研究者的回应。

  2. IT之家·人工智能

    OpenAI 公布 700 多份数学研究文稿,数学界反应分化并担忧合作传统受损

    OpenAI 于当地时间 6 日在 GitHub 公开 700 多份数学研究文稿,称成果出自公司内部一款前沿 AI 模型,许多数学证明附有可供计算机验证的版本。

  3. The Verge:AI

    数学家称消化 OpenAI 突然发布的近 400 项 AI 数学结果可能需要数年

    OpenAI 本周突然发布近 400 项 AI 生成的数学结果,分布在 719 份手稿中,涵盖组合数学、数论、拓扑等多个学科,其中仅约 42% 已在 Lean 中形式化验证。

10月9日周五

  1. The Decoder:AI News

    部分数学家呼吁抵制 OpenAI,AI 生成的数学证明涌入数学领域

    AHM 组织在 Terence Tao 主持下发表声明,呼吁抵制 OpenAI,称其一次性发布 700 多个 AI 生成证明文件是展示力量而非学术行为。此前 OpenAI 宣称内部模型一个月内解决逾 100 个开放数学问题,约 8000 个测试问题成功率约 5%,平均每个耗时 3 小时 GPT-Pro 级算力。

10月8日周四

  1. 卡卡兹克

    OpenAI 发布 722 份数学手稿后,卡兹克长文解读 AI 如何改变数学研究

    卡兹克长文解读 OpenAI 10 月 7 日在 GitHub 仓库 openai/math 发布的 722 份数学手稿,归为 372 组成果,覆盖数论、代数几何等方向,全部出自未公开的内部模型,平均每个结果约花 3 小时 ChatGPT Pro 级别算力。

  2. 公众号:数字生命卡兹克

    OpenAI 在 GitHub 发布 openai/math 仓库,722 份数学手稿引发数学界震荡

    OpenAI 于10月7日在 GitHub 发布 openai/math 仓库,收录其未公开内部模型产出的722份数学手稿,归为372个成果组,覆盖数论、代数几何、偏微分方程等方向,每个结果平均花费约3小时 ChatGPT Pro 级别思考算力。

10月7日周三

  1. The Decoder:AI News

    OpenAI 在 GitHub 发布 372 个 AI 生成的数学证明结果

    OpenAI 在 GitHub 发布了 372 个由内部前沿模型生成的数学结果,每个结果据称解决或实质推进一个开放问题,包括对主要计算机算法的改进和与黎曼猜想相关的进展。

  2. GGreg Brockman

    OpenAI 发布内部前沿模型产出的多项数学新结果

    OpenAI 发布一系列由内部前沿模型产出的新数学结果,仓库地址 https://github.com/openai/math。发布前咨询了高等研究院数学与人工智能独立顾问小组,并参考其建议和公开推荐来决定发布方式。Greg Brockman 转发此事,称其朝加速科学发现和改善每个人生活质量的方向迈进。

  3. Nathan Lambert

    OpenAI 发布内部模型数学成果

    给这个"数学"起的 GitHub 仓库名太搞笑了 @OpenAI: 我们正在发布由内部前沿模型产出的一系列广泛的新数学成果。 我们一直在与普林斯顿高等研究院的数学与人工智能独立咨询小组磋商,并借鉴了他们的建议和公开推荐来指导我们发布这些成果的方式。 https://github.com/openai/math

  4. Rohan Paul

    OpenAI 发布 722 篇 AI 生成的数学证明论文

    OpenAI 发布 722 篇 AI 生成的数学证明论文,覆盖 372 个数学结果族。其中矩阵乘法证明将 2 个 n×n 矩阵乘法的已证明成本从 AlphaEvolve 今年 8 月创下的约 n^2.371177 降至约 n^2.25,并附 Lean 形式化,但这是理论界,尚未给工程师提供可用于真实 GPU 负载的更快例程;这些结果来自内部模型处理约 4K 研究问题后的分组过滤,每个平均使用约相当于 3 小时 ChatGPT Pro 思考的算力。

  5. IT之家·人工智能

    OpenAI 公布未发布前沿模型解决的数百个数学难题研究成果

    OpenAI 公布一批含 722 份手稿、372 个结果家族的文件,展示某款未发布前沿模型对数百个未解决数学难题的解答,成果发布在 GitHub 仓库中。咨询小组 AGMAI 呼吁通过学术渠道发布并披露模型名称、提示词和算力开销,称一项普通成果的算力大致相当于 ChatGPT Pro 连续思考三小时。

  6. Rohan Paul

    OpenAI 公开内部模型数学成果论文:722 篇手稿覆盖 372 项结果

    OpenAI 在 GitHub 公开发布内部前沿模型产出的数学论文与证明材料,共 722 篇手稿,整理为 372 个结果族。测试时模型被喂入约 4K 个研究问题,每项结果平均使用相当于 3 小时 ChatGPT Pro 思考的算力;部分结果尚无 Lean 形式化,可能存在问题,仓库将持续更新。

  7. The Verge:AI

    OpenAI 通过 GitHub 发布 722 份数学论文手稿,称含数百个公开问题解答

    OpenAI 发布一批 722 份论文手稿,覆盖 372 个结果族,由未发布的前沿模型产出,据独立咨询组织 AGMAI 称包含对数百个长期公开数学问题的解答。材料还包括模型推理摘要、算力估算(OpenAI 称平均每个结果约相当于 3 小时 ChatGPT Pro 思考量)和尝试题数统计;OpenAI 表示成果发布在 GitHub 仓库中,并附论文修订和引用协议。

  8. Thomas Wolf

    OpenAI 发布内部前沿模型产出的新数学结果

    OpenAI 宣布发布由内部前沿模型产出的一批新数学结果,材料已在 GitHub 开放。发布方式参考了高等研究院数学与人工智能独立咨询组的建议和公开推荐。

  9. OOpenAI:官网动态官方

    OpenAI 发布内部前沿模型产出的数学研究成果

    OpenAI 发布一批由内部前沿模型产出的新数学成果,成果以 GitHub 仓库形式公开,并附论文修订与引用协议,其中许多证明已用 Lean 形式化以便计算机验证。

  10. Testing Catalog

    OpenAI 发布仓库,公开其未发布前沿模型求解的一系列数学新结果

    OpenAI 发布 GitHub 仓库 https://github.com/openai/math,公开由内部前沿模型产生的一系列新数学结果,并咨询了高等研究院数学与人工智能独立咨询小组。绝大多数结果由同一流程、用未发布的内部模型完成,平均每个结果使用三小时 ChatGPT Pro thinking 算力,评估期间模型共被提出约 4,000 个问题;例外包括黎曼 zeta 函数零点自由区域和 CM 阿贝尔簇上 Hodge 猜想证明的相关工作,其中 Re(s) > 11/12 零点自由区域的文稿经人工编辑以提升可读性。

  11. Tibo官方

    OpenAI 模型解决重要数学问题

    今天发布的其它内容完全无关,但我们的模型确实解决了一些重要的数学问题,团队在下面这篇博客中做了记录。科学进步的新时代,令人瞩目。 https://openai.com/index/sharing-ai-progress-in-mathematics/

  12. OOpenAI

    OpenAI 发布内部前沿模型产出的新数学成果

    OpenAI 发布由内部前沿模型产出的一批新数学结果,链接为 https://github.com/openai/math。发布前咨询了普林斯顿高等研究院(IAS)数学与人工智能独立顾问组,并依据其建议和公开建议决定发布方式。

10月6日周二

  1. The Verge:AI

    AI 接管数学界引发争议:OpenAI、Anthropic 的数学突破与学界反弹

    过去一年 OpenAI、Anthropic 等实验室宣布解决多个长期数学难题,包括一个千禧年大奖难题,进展超出研究者对现有系统的预期。但这些突破在学界引发反弹,数学家要求 OpenAI 证明未使用其成果,AI 实验室称正从早期错误中学习。

9月30日周三

  1. HHacker News:AI 热帖

    数学社区发布 AI 生成数学成果的负责任发布建议

    agmai.org 于 9 月 29 日发布《Responsible Release of AI-Generated Mathematics》,针对 AI 实验室发布数学成果提出建议,并明确反对在闭源模型上测试高难度数学问题。