论文

策略即逻辑:面向规则之上稳健推理的方法

Policy-as-logic for robust reasoning over rules

模型推理推理策略与问题分解

摘要

在生成式AI系统的许多实际应用中,从税收到航空公司行李额度,对自然语言查询的响应必须遵守成文的政策或规则。我们提出一种混合符号方法,以形式逻辑表达政策,并在推理时利用语言模型的表示能力进行事实抽取以锚定谓词,同时使用答案集求解器进行推理,使响应可解释、可审计,并且如我们所展示的,在输入扰动下准确且稳健。具体而言,我们展示了这种抽取与推理步骤的分离在多数情况下优于policy-as-prompt和policy-as-code方法,且token使用量降低约10倍。结果指出了结构化推理与符号求解器结合生成式模型在涉及客观标准的稳健决策中的价值。