OpenAI 公开内部前沿模型的 722 篇数学手稿与 Lean 证明
2026/10/06 — 10/07 08:18·5 个来源(全部)·5 篇报道(全部)·入选 10-07 日报
核心速览 (Key Takeaways)
- OpenAI 表示正公开一批由尚未发布的内部前沿模型产出的数学结果,共 722 篇手稿、归入 372 个问题族。
- 内容发布在 GitHub 的 openai/math 仓库,采用 Apache-2.0 许可,并附有 Lean 形式化证明与模型推理节选。
- 公开形式化证明意味着外部研究者可以自行核验推导过程。
事件背景与详细解读
2026 年 10 月 6 日,OpenAI 发布一篇研究文章,公布一个尚未发布的内部前沿模型在数学开放问题上取得的新结果,并把 Lean 形式化证明与研究细节一起发布到 GitHub。据 Unite.AI 报道,这批内容共 722 篇手稿,归入 372 个问题族,放在 openai/math 仓库,采用 Apache-2.0 许可,同时附有 Lean 形式化证明以及模型推理的节选摘要。公开形式化证明意味着外部研究者可以自行查看这些推导,而不必只依赖官方说法。
次日凌晨,TestingCatalog 报道称,绝大多数结果由同一个流程、同一个尚未公开的内部模型得出,每个结果据称平均使用约三小时。Unite.AI 与 The Verge 也都写明是 722 篇手稿、372 个相关成果族。IT 之家 10 月 7 日的报道补充说,新成立的独立数学家咨询小组 AGMAI 称其中包含对「数百个」未解决问题的解答,这批资料还包含部分推理过程摘要、算力消耗估算值,以及尝试求解过的问题数量统计。
按 IT 之家的说法,OpenAI 称一项普通成果所消耗的算力大致相当于 ChatGPT Pro 连续思考三小时。该公司曾在九月称,自家模型已解决一百余个长期悬而未决的公开难题,覆盖数学的绝大多数分支领域;而在此之前数周,外界一直在期待这批成果,OpenAI 始终没有说明模型究竟解决了哪些问题,也没有
AI 综合 5 篇报道生成 · 更新于 45 分钟前
最新进展据 IT 之家报道,OpenAI 公布了一批包含 722 份手稿、涵盖 372 个结果家族的文件,为一个未发布的前沿模型解决的多项长期数学难题,新成立的独立数学家咨询小组 AGMAI 称其中包含对「数百个」未解决问题的解答。OpenAI 称一项普通成果的算力大致相当于 ChatGPT Pro 连续思考三小时,资料还包含部分推理过程摘要与算力消耗估算。
关联 AI 工具与体验
- 热度指数
- 449
- 全部来源
- 5
- 全部报道
- 5
- 首报
- 13 小时前
这件事的报道 点标题看原文
据 IT 之家报道,OpenAI 公布了一批包含 722 份手稿、涵盖 372 个结果家族的文件,为一个未发布的前沿模型解决的多项长期数学难题,新成立的独立数学家咨询小组 AGMAI 称其中包含对「数百个」未解决问题的解答。OpenAI 称一项普通成果的算力大致相当于 ChatGPT Pro 连续思考三小时,资料还包含部分推理过程摘要与算力消耗估算。
AI 攻数学难题的规模与算力代价首次被具体披露
IT之家AI 评分 64据 The Verge 报道,OpenAI 公布了一批由一个未发布的前沿模型给出的数学问题解答,共 722 篇手稿,归入 372 个相关成果族。这批结果延续了该模型此前在数学界的突破势头,也引发关于研究伦理的讨论。
看前沿模型在数学上又推进到哪一步
The Verge · AIAI 评分 62据 Unite.AI 报道,OpenAI 在一篇研究文章中表示,正公开一批由一个尚未发布的内部前沿模型产出的数学结果,共 722 篇手稿,归入 372 个问题族。这些内容发布在 GitHub 的 openai/math 仓库,采用 Apache-2.0 许可,并附有 Lean 形式化证明和模型推理的节选摘要。
观察前沿模型数学能力的一条公开线索
Unite.AIAI 评分 67据 TestingCatalog 报道,OpenAI 发布了一个仓库,收录其下一代前沿模型对一批数学问题给出的新解法。绝大多数结果由同一个流程、同一个尚未公开的内部模型得出,每个结果据称平均使用约三小时。
提前看到未发布前沿模型的数学能力
X:TestingCatalog (@testingcatalog)AI 评分 60
OpenAI 公布了一个内部前沿模型在数学开放问题上取得的新结果,并把 Lean 形式化证明与研究细节一起发布到 GitHub。公开形式化证明意味着外部研究者可以自行查看这些推导,而不是只依赖官方说法。
看前沿模型在数学开放问题上能走多远的一手材料
OpenAI News官方AI 评分 72
同时在说的其他事
- 热度指数 27安全研究员发现利用 JSFuck 混淆绕过 Manus AI 护栏的漏洞1 个来源
- 热度指数 842发酵中Mistral 发布 1 万亿参数开放权重模型 Large 411 个来源
- 热度指数 582爆DeepMind 发布 740M 多模态嵌入模型 EmbeddingGemma 27 个来源
- 热度指数 433DeepSeek 被曝拟融资至少 120 亿美元,腾讯宁德时代为主要出资方7 个来源
- 热度指数 410维基媒体称 OpenAI 智能体越界活动或致 5 月服务中断8 个来源
热度怎么算的?了解口径收起
热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。
本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。如权利人认为相关标题或摘要侵权,请通过页尾联系邮箱提供具体页面与权利依据,我们核实后会及时删除或替换。
- 爆
- 讨论快速增加
- 新
- 首报 6 小时内
- 发酵中
- 讨论仍在增加
