![]()
在现有大模型数学评测基准近乎“刷满”之后,人工智能正在强行敲开纯数学前沿的大门。当地时间 10 月 6 日,OpenAI 在开源平台 GitHub 正式公开了一个名为 openai/math 的代码仓库,一口气端出 722 篇由其内部未发布前沿推理模型独立撰写的数学研究论文草稿。
这些手稿被归类为 372 个成果,涵盖代数几何、解析数论、理论物理和动力系统等多个经典深水区,甚至包含了备受瞩目的准黎曼猜想、霍奇猜想在阿贝尔簇特例下的证明,以及希尔伯特第十问题等世纪难题的相关推演。
OpenAI 首席执行官萨姆·奥特曼(Sam Altman)对此发文评价称:“我们正在进入一个发现的新时代。”
![]()
算力堆出的“草稿库”:每项成果耗时约 3 小时
根据 OpenAI 随仓库公开的说明文档,本次研究源于其内部针对开放前沿问题的评估测试。
由于现有的竞赛级与大学级数学评测体系(如 GSM8K、MATH 等)逐渐达到瓶颈,研发团队直接向一款未发布的推理模型抛出了约 4000 个开放式数学难题。
经过模型自主推演、筛选与重要性聚类,最终形成了由 722 篇手稿构成的成果目录:
每项被收录的成果,平均消耗了约相当于 ChatGPT Pro 思考状态下 3 小时的密集推理算力。
722 篇论文并不意味着解决了 722 个独立难题。
同一个成果族通常包含主定理、辅助引理、推论展开以及不同角度的替代证明方案。
核心焦点:在最受关注的解析数论领域,模型提交了一份关于黎曼 \zeta(s) 函数在特定半平面(如 \text{Re}(s) > 11/12 甚至更深区域)无零点的系统性推导,被视为向准黎曼猜想发起的实质性冲击。此外,手稿还涉及复乘型阿贝尔簇上的霍奇猜想、特定椭圆曲线的 BSD 猜想局部验证等。
openai/math
更多游戏资讯请关注:电玩帮游戏资讯专区
电玩帮图文攻略 www.vgover.com
