HaiAI123

全球AI工具精选导航

爆行业动态
↑ 551%

OpenAI 公开内部前沿模型的 722 篇数学手稿与 Lean 证明

2026/10/06 — 10/07 08:18·5 个来源(全部)·5 篇报道(全部)·入选 10-07 日报

核心速览 (Key Takeaways)

  • OpenAI 表示正公开一批由尚未发布的内部前沿模型产出的数学结果,共 722 篇手稿、归入 372 个问题族。
  • 内容发布在 GitHub 的 openai/math 仓库,采用 Apache-2.0 许可,并附有 Lean 形式化证明与模型推理节选。
  • 公开形式化证明意味着外部研究者可以自行核验推导过程。

事件背景与详细解读

2026 年 10 月 6 日,OpenAI 发布一篇研究文章,公布一个尚未发布的内部前沿模型在数学开放问题上取得的新结果,并把 Lean 形式化证明与研究细节一起发布到 GitHub。据 Unite.AI 报道,这批内容共 722 篇手稿,归入 372 个问题族,放在 openai/math 仓库,采用 Apache-2.0 许可,同时附有 Lean 形式化证明以及模型推理的节选摘要。公开形式化证明意味着外部研究者可以自行查看这些推导,而不必只依赖官方说法。

次日凌晨,TestingCatalog 报道称,绝大多数结果由同一个流程、同一个尚未公开的内部模型得出,每个结果据称平均使用约三小时。Unite.AI 与 The Verge 也都写明是 722 篇手稿、372 个相关成果族。IT 之家 10 月 7 日的报道补充说,新成立的独立数学家咨询小组 AGMAI 称其中包含对「数百个」未解决问题的解答,这批资料还包含部分推理过程摘要、算力消耗估算值,以及尝试求解过的问题数量统计。

按 IT 之家的说法,OpenAI 称一项普通成果所消耗的算力大致相当于 ChatGPT Pro 连续思考三小时。该公司曾在九月称,自家模型已解决一百余个长期悬而未决的公开难题,覆盖数学的绝大多数分支领域;而在此之前数周,外界一直在期待这批成果,OpenAI 始终没有说明模型究竟解决了哪些问题,也没有

AI 综合 5 篇报道生成 · 更新于 45 分钟前

最新进展据 IT 之家报道,OpenAI 公布了一批包含 722 份手稿、涵盖 372 个结果家族的文件,为一个未发布的前沿模型解决的多项长期数学难题,新成立的独立数学家咨询小组 AGMAI 称其中包含对「数百个」未解决问题的解答。OpenAI 称一项普通成果的算力大致相当于 ChatGPT Pro 连续思考三小时,资料还包含部分推理过程摘要与算力消耗估算。

关联 AI 工具与体验

24 小时热度热度指数 449 · 峰值 460 · 1 小时前
24 小时前现在

这件事的报道 点标题看原文

今天
  1. 据 IT 之家报道,OpenAI 公布了一批包含 722 份手稿、涵盖 372 个结果家族的文件,为一个未发布的前沿模型解决的多项长期数学难题,新成立的独立数学家咨询小组 AGMAI 称其中包含对「数百个」未解决问题的解答。OpenAI 称一项普通成果的算力大致相当于 ChatGPT Pro 连续思考三小时,资料还包含部分推理过程摘要与算力消耗估算。

    AI 攻数学难题的规模与算力代价首次被具体披露

    IT之家AI 评分 64
  2. 据 The Verge 报道,OpenAI 公布了一批由一个未发布的前沿模型给出的数学问题解答,共 722 篇手稿,归入 372 个相关成果族。这批结果延续了该模型此前在数学界的突破势头,也引发关于研究伦理的讨论。

    看前沿模型在数学上又推进到哪一步

    The Verge · AIAI 评分 62
  3. 据 Unite.AI 报道,OpenAI 在一篇研究文章中表示,正公开一批由一个尚未发布的内部前沿模型产出的数学结果,共 722 篇手稿,归入 372 个问题族。这些内容发布在 GitHub 的 openai/math 仓库,采用 Apache-2.0 许可,并附有 Lean 形式化证明和模型推理的节选摘要。

    观察前沿模型数学能力的一条公开线索

    Unite.AIAI 评分 67
  4. 据 TestingCatalog 报道,OpenAI 发布了一个仓库,收录其下一代前沿模型对一批数学问题给出的新解法。绝大多数结果由同一个流程、同一个尚未公开的内部模型得出,每个结果据称平均使用约三小时。

    提前看到未发布前沿模型的数学能力

    X:TestingCatalog (@testingcatalog)AI 评分 60
昨天
  1. OpenAI 公布了一个内部前沿模型在数学开放问题上取得的新结果,并把 Lean 形式化证明与研究细节一起发布到 GitHub。公开形式化证明意味着外部研究者可以自行查看这些推导,而不是只依赖官方说法。

    看前沿模型在数学开放问题上能走多远的一手材料

    OpenAI News官方AI 评分 72

同时在说的其他事

热度怎么算的?了解口径

热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。

本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。如权利人认为相关标题或摘要侵权,请通过页尾联系邮箱提供具体页面与权利依据,我们核实后会及时删除或替换。

爆
讨论快速增加
新
首报 6 小时内
发酵中
讨论仍在增加

回 AI 行业动态榜 →