OpenAI 公開內部前沿模型的 722 篇數學手稿與 Lean 證明
2026/10/06 — 10/07 08:18·5 個來源(全部)·5 篇報道(全部)·入選 10-07 日報
核心速覽 (Key Takeaways)
- OpenAI 表示正公開一批由尚未釋出的內部前沿模型產出的數學結果,共 722 篇手稿、歸入 372 個問題族。
- 內容釋出在 GitHub 的 openai/math 倉庫,採用 Apache-2.0 許可,並附有 Lean 形式化證明與模型推理節選。
- 公開形式化證明意味著外部研究者可以自行核驗推導過程。
事件背景與詳細解讀
2026 年 10 月 6 日,OpenAI 釋出一篇研究文章,公佈一個尚未釋出的內部前沿模型在數學開放問題上取得的新結果,並把 Lean 形式化證明與研究細節一起釋出到 GitHub。據 Unite.AI 報道,這批內容共 722 篇手稿,歸入 372 個問題族,放在 openai/math 倉庫,採用 Apache-2.0 許可,同時附有 Lean 形式化證明以及模型推理的節選摘要。公開形式化證明意味著外部研究者可以自行檢視這些推導,而不必只依賴官方說法。
次日凌晨,TestingCatalog 報道稱,絕大多數結果由同一個流程、同一個尚未公開的內部模型得出,每個結果據稱平均使用約三小時。Unite.AI 與 The Verge 也都寫明是 722 篇手稿、372 個相關成果族。IT 之家 10 月 7 日的報道補充說,新成立的獨立數學家諮詢小組 AGMAI 稱其中包含對「數百個」未解決問題的解答,這批資料還包含部分推理過程摘要、算力消耗估算值,以及嘗試求解過的問題數量統計。
按 IT 之家的說法,OpenAI 稱一項普通成果所消耗的算力大致相當於 ChatGPT Pro 連續思考三小時。該公司曾在九月稱,自家模型已解決一百餘個長期懸而未決的公開難題,覆蓋數學的絕大多數分支領域;而在此之前數週,外界一直在期待這批成果,OpenAI 始終沒有說明模型究竟解決了哪些問題,也沒有
AI 綜合 5 篇報道生成 · 更新於 47 分鐘前
最新進展據 IT 之家報道,OpenAI 公佈了一批包含 722 份手稿、涵蓋 372 個結果家族的檔案,為一個未釋出的前沿模型解決的多項長期數學難題,新成立的獨立數學家諮詢小組 AGMAI 稱其中包含對「數百個」未解決問題的解答。OpenAI 稱一項普通成果的算力大致相當於 ChatGPT Pro 連續思考三小時,資料還包含部分推理過程摘要與算力消耗估算。
關聯 AI 工具與體驗
- 熱度指數
- 446
- 全部來源
- 5
- 全部報道
- 5
- 首報
- 13 小時前
這件事的報道 點標題看原文
據 IT 之家報道,OpenAI 公佈了一批包含 722 份手稿、涵蓋 372 個結果家族的檔案,為一個未釋出的前沿模型解決的多項長期數學難題,新成立的獨立數學家諮詢小組 AGMAI 稱其中包含對「數百個」未解決問題的解答。OpenAI 稱一項普通成果的算力大致相當於 ChatGPT Pro 連續思考三小時,資料還包含部分推理過程摘要與算力消耗估算。
AI 攻數學難題的規模與算力代價首次被具體披露
IT之家AI 評分 64據 The Verge 報道,OpenAI 公佈了一批由一個未釋出的前沿模型給出的數學問題解答,共 722 篇手稿,歸入 372 個相關成果族。這批結果延續了該模型此前在數學界的突破勢頭,也引發關於研究倫理的討論。
看前沿模型在數學上又推進到哪一步
The Verge · AIAI 評分 62據 Unite.AI 報道,OpenAI 在一篇研究文章中表示,正公開一批由一個尚未釋出的內部前沿模型產出的數學結果,共 722 篇手稿,歸入 372 個問題族。這些內容釋出在 GitHub 的 openai/math 倉庫,採用 Apache-2.0 許可,並附有 Lean 形式化證明和模型推理的節選摘要。
觀察前沿模型數學能力的一條公開線索
Unite.AIAI 評分 67據 TestingCatalog 報道,OpenAI 釋出了一個倉庫,收錄其下一代前沿模型對一批數學問題給出的新解法。絕大多數結果由同一個流程、同一個尚未公開的內部模型得出,每個結果據稱平均使用約三小時。
提前看到未釋出前沿模型的數學能力
X:TestingCatalog (@testingcatalog)AI 評分 60
OpenAI 公佈了一個內部前沿模型在數學開放問題上取得的新結果,並把 Lean 形式化證明與研究細節一起釋出到 GitHub。公開形式化證明意味著外部研究者可以自行檢視這些推導,而不是隻依賴官方說法。
看前沿模型在數學開放問題上能走多遠的一手材料
OpenAI News官方AI 評分 72
同時在說的其他事
- 熱度指數 27安全研究員發現利用 JSFuck 混淆繞過 Manus AI 護欄的漏洞1 個來源
- 熱度指數 836發酵中Mistral 釋出 1 萬億引數開放權重模型 Large 411 個來源
- 熱度指數 577爆DeepMind 釋出 740M 多模態嵌入模型 EmbeddingGemma 27 個來源
- 熱度指數 429DeepSeek 被曝擬融資至少 120 億美元,騰訊寧德時代為主要出資方7 個來源
- 熱度指數 407維基媒體稱 OpenAI 智慧體越界活動或致 5 月服務中斷8 個來源
熱度怎麼算的?瞭解口徑收起
熱度按 48 小時內有多少個獨立來源在說這件事算:同一個來源發多條只算一次,並按 24 小時半衰期衰減,所以排前面的是很多人在說的事。
本頁彙總公開訂閱源,標題與摘要由模型整理,版權歸原作者所有;重要資訊請回原文核對。如權利人認為相關標題或摘要侵權,請通過頁尾聯絡郵箱提供具體頁面與權利依據,我們核實後會及時刪除或替換。
- 爆
- 討論快速增加
- 新
- 首報 6 小時內
- 發酵中
- 討論仍在增加
