论文

形式公理系统中的自监督定理发现

Self-Supervised Theorem Discovery in a Formal Axiomatic System

上下文与知识知识获取与更新

摘要

近期人工智能(AI)系统在数学推理上取得显著进展。许多既有方法——包括大语言模型(LLM)——汲取数学文本、代码或定理库等人类先验知识。虽然这些方法实践上高效——但智能体能否在没有此类人类先验的情况下自主发现有用定理仍是开放问题。我们在形式公理系统中研究该问题——开发一个仅从公理与推理规则出发、逐步增长有用定理库的智能体。具体地——我们提出自监督定理发现算法——在证明搜索与有用定理抽取间交替——构建其条目被复用为后续证明搜索引理的定理库。实验表明该智能体发现数万条定理——并为人类撰写的基准问题找到证明——提示其发现包含从人类数学视角有意义的定理。此外——发现的定理作为提示引理提供时改进LLM证明性能——表明它们可作LLM推理的外部知识。我们的结果提供有用定理可从证明搜索涌现而不依赖人类定理库的证据。更广地——它们提示一条通往数学自演化AI系统的路径——其发现保持形式可验证。

形式公理系统中的自监督定理发现:论文配图
图 1:希尔伯特系统和 A→AA\to A 的证明树。顶部:三个公理和 Modus Ponens。公理分别表示弱化、蕴涵分布、对立。底部:从两个 Ax1 实例、一个 Ax2 实例和两个 Modus Ponens 步骤派生 A→AA\to A 的证明树。