开源发布数百份手稿与推理摘要
2026年10月6日,OpenAI在名为'openai/math'的GitHub仓库中集中发布了722份数学手稿,这些成果被划分为372个结果家族。OpenAI声称,这些数学研究成果均由其尚未正式发布的内部前沿模型计算得出。
此次公开的文件涵盖论文PDF、源代码、部分结果的Lean语言形式化证明,以及10份经过删减的模型推理过程摘要。
在计算资源消耗方面,OpenAI官方估算,得出每个结果所消耗的平均算力,大致相当于该内部模型在ChatGPT Pro环境下持续进行约三小时的深度思考。
覆盖多个分支难题 但验证状态依然不均
根据媒体报道,该批手稿声称解决了多个数学核心领域的难题,包括数论、几何、理论计算机科学、代数、数学物理以及微分方程等。
手稿中列举的具体成果包括Mahler猜想的解、π的精确无理数指数、唯一游戏猜想,以及相对论Vlasov-Maxwell系统的全局正则性等知名数学命题。
然而,这722份手稿目前的验证情况参差不齐,原因在于其中并非所有结果都配备了可供计算机自动验证的Lean形式化证明。
OpenAI已明确提醒,未经形式化验证的结果可能包含错误,并表示将随着后续验证进程的推进持续更新该仓库中的内容。
伦理争议下的应对与学术独立检验
此次大规模公开举措与此前的一系列争议直接相关。2026年9月8日,OpenAI曾宣布其内部模型GPT-6 Astra攻克了千禧年大奖难题之一的Navier-Stokes存在性与光滑性问题。
该声明随后在学界引发了针对学术伦理和成果优先权的质疑,数学家Tristan Buckmaster与Levent Alpöge公开指控OpenAI涉嫌抢先使用了他们尚未发表的研究工作。
为应对业界的强烈抗议,由普林斯顿高等研究院(IAS)托管的独立组织数学与人工智能咨询小组(AGMAI)于9月21日正式成立。
AGMAI此前明确敦促科技公司不要将高深数学成果单纯当作营销噱头,并要求停止在专有模型上私下测试高级数学难题;OpenAI在10月6日公开相关手稿的行为,被普遍视为对AGMAI建议的初步回应。
有分析指出,此番发布为全球数学共同体提供了一个包含海量AI证明与推理痕迹的公共数据集,为接下来的独立审查和同行验证提供了关键材料。

