OpenAI 拋出 722 篇未發表模型撰寫的數學手稿,稱觸碰準黎曼猜想

在現有大模型數學評測基準近乎“刷滿”之後,人工智能正在強行敲開純數學前沿的大門。當地時間 10 月 6 日,OpenAI 在開源平臺 GitHub 正式公開了一個名爲 openai/math 的代碼倉庫,一口氣端出 722 篇由其內部未發佈前沿推理模型獨立撰寫的數學研究論文草稿。

這些手稿被歸類爲 372 個成果,涵蓋代數幾何、解析數論、理論物理和動力系統等多個經典深水區,甚至包含了備受矚目的準黎曼猜想、霍奇猜想在阿貝爾簇特例下的證明,以及希爾伯特第十問題等世紀難題的相關推演。

OpenAI 首席執行官薩姆·奧特曼(Sam Altman)對此發文評價稱:“我們正在進入一個發現的新時代。”

  

算力堆出的“草稿庫”:每項成果耗時約 3 小時

根據 OpenAI 隨倉庫公開的說明文檔,本次研究源於其內部針對開放前沿問題的評估測試。

由於現有的競賽級與大學級數學評測體系(如 GSM8K、MATH 等)逐漸達到瓶頸,研發團隊直接向一款未發佈的推理模型拋出了約 4000 個開放式數學難題。

經過模型自主推演、篩選與重要性聚類,最終形成了由 722 篇手稿構成的成果目錄:  

 每項被收錄的成果,平均消耗了約相當於 ChatGPT Pro 思考狀態下 3 小時的密集推理算力。

 722 篇論文並不意味着解決了 722 個獨立難題。

同一個成果族通常包含主定理、輔助引理、推論展開以及不同角度的替代證明方案。  

 核心焦點:在最受關注的解析數論領域,模型提交了一份關於黎曼 \zeta(s) 函數在特定半平面(如 \text{Re}(s) > 11/12 甚至更深區域)無零點的系統性推導,被視爲向準黎曼猜想發起的實質性衝擊。此外,手稿還涉及復乘型阿貝爾簇上的霍奇猜想、特定橢圓曲線的 BSD 猜想局部驗證等。 

openai/math

更多遊戲資訊請關註:電玩幫遊戲資訊專區

電玩幫圖文攻略 www.vgover.com