ESC
AI 1 分钟阅读

OpenAI 公开内部 AI 模型生成的 722 篇数学研究手稿

OpenAI 发布一个代码仓库,收录其内部未发布模型产出的 722 份数学研究手稿,归为 372 个家族,涉及黎曼 zeta 函数零点自由区域、CM 阿贝尔簇 Hodge 猜想等开放问题,并附部分模型推理摘要。多数结果平均耗费约 3 小时 ChatGPT Pro 思考算力,部分已提供 Lean 形式化证明。

来源:GitHub

自述文件

本仓库包含由 OpenAI 内部模型生成的数学手稿及配套证明材料。

作为模型开发的一部分,我们在开放研究问题上对模型进行评估。在现有数学评估基准上的性能趋于饱和后,我们扩展了这些评估。其中一些输出建立在模型此前产出的结果之上。

本合集包含处于不同验证阶段的结果。并非所有结果都附有 Lean 形式化证明。随着获得更多 Lean 形式化证明,我们将持续更新本仓库。

部分未形式化的结果可能存在问题。我们将尽力迅速修复此类问题。 我们也在探索由社区托管的仓库来存放这些材料。

浏览本合集

当前目录包含 722 份手稿,组织为 372 个家族。一个家族将相关论文归为一组,可能包括主要结果、配套论证、推论或替代证明。每个家族按数学学科分类。

  • 从概览开始,了解各家族的描述。
  • 使用手稿地图查找单篇论文及其支持材料。
  • preprints/ 目录包含 PDF、源文件以及各手稿的引用和构建说明。
  • Lean 库和形式化目录描述了可用的形式化证明、对应论文及验证配置。更多核查说明请参见 Comparator 指南。许多(但并非全部)手稿已完成形式化。

推理摘要

我们还发布了模型推理过程的节选摘要,涵盖以下结果:

家族主题
007乘性函数的普通二点相关性
017π 的无理性指数
087对称与一般 Mahler 猜想
102基本半定阈值处的普通 NP 难度
159等差数列的拟多项式界
197特征 2 下的 Kaplansky 直有限性猜想
221稀释自旋玻璃的 Mézard–Parisi 公式
271量子海森堡铁磁体中的自发磁化
287自由群因子的同构
362三维相对论性 Vlasov–Maxwell 系统

结果是如何产生的

绝大多数结果都是通过相同的流程、使用一个未发布的 OpenAI 内部模型获得的。平均而言,每个结果使用了该模型约三小时的 ChatGPT Pro 思考算力。在整个评估过程中,该模型共被提出了约 4,000 个问题。将输出聚合为结果家族和手稿,并要求达到适当的显著性水平,最终形成了上述目录。

例外情况包括关于黎曼 zeta 函数零点自由区域的工作,以及对 CM 阿贝尔簇的 Hodge 猜想的证明。此外,关于黎曼 zeta 函数 Re(s) > 11/12 零点自由区域的论文经人工编辑以提高可读性。

版本与引用

我们将保留本合集的公开发布历史。更正和修订将作为新版本记录,先前发布的版本仍可访问。

引用单篇手稿时,请使用其目录中的 BibTeX 块。