自述文件
本仓库包含由 OpenAI 内部模型生成的数学手稿及配套证明材料。
作为模型开发的一部分,我们在开放研究问题上对模型进行评估。在现有数学评估基准上的性能趋于饱和后,我们扩展了这些评估。其中一些输出建立在模型此前产出的结果之上。
本合集包含处于不同验证阶段的结果。并非所有结果都附有 Lean 形式化证明。随着获得更多 Lean 形式化证明,我们将持续更新本仓库。
部分未形式化的结果可能存在问题。我们将尽力迅速修复此类问题。 我们也在探索由社区托管的仓库来存放这些材料。
浏览本合集
当前目录包含 722 份手稿,组织为 372 个家族。一个家族将相关论文归为一组,可能包括主要结果、配套论证、推论或替代证明。每个家族按数学学科分类。
- 从概览开始,了解各家族的描述。
- 使用手稿地图查找单篇论文及其支持材料。
preprints/目录包含 PDF、源文件以及各手稿的引用和构建说明。- Lean 库和形式化目录描述了可用的形式化证明、对应论文及验证配置。更多核查说明请参见 Comparator 指南。许多(但并非全部)手稿已完成形式化。
推理摘要
我们还发布了模型推理过程的节选摘要,涵盖以下结果:
| 家族 | 主题 |
|---|---|
| 007 | 乘性函数的普通二点相关性 |
| 017 | π 的无理性指数 |
| 087 | 对称与一般 Mahler 猜想 |
| 102 | 基本半定阈值处的普通 NP 难度 |
| 159 | 等差数列的拟多项式界 |
| 197 | 特征 2 下的 Kaplansky 直有限性猜想 |
| 221 | 稀释自旋玻璃的 Mézard–Parisi 公式 |
| 271 | 量子海森堡铁磁体中的自发磁化 |
| 287 | 自由群因子的同构 |
| 362 | 三维相对论性 Vlasov–Maxwell 系统 |
结果是如何产生的
绝大多数结果都是通过相同的流程、使用一个未发布的 OpenAI 内部模型获得的。平均而言,每个结果使用了该模型约三小时的 ChatGPT Pro 思考算力。在整个评估过程中,该模型共被提出了约 4,000 个问题。将输出聚合为结果家族和手稿,并要求达到适当的显著性水平,最终形成了上述目录。
例外情况包括关于黎曼 zeta 函数零点自由区域的工作,以及对 CM 阿贝尔簇的 Hodge 猜想的证明。此外,关于黎曼 zeta 函数 Re(s) > 11/12 零点自由区域的论文经人工编辑以提高可读性。
版本与引用
我们将保留本合集的公开发布历史。更正和修订将作为新版本记录,先前发布的版本仍可访问。
引用单篇手稿时,请使用其目录中的 BibTeX 块。