论文

三思而后言:面向说服型智能体的双重知识增强心智理论推理

Think Thrice Before You Speak: Dual knowledge-enhanced Theory-of-Mind Reasoning for Persuasive Agents

模型推理推理策略与问题分解

摘要

说服性对话需要推理他人的潜在心理状态,这一能力被称为心智理论(ToM)。然而,由于依赖简单提示策略且ToM知识不足,现有LLM往往难以捕捉心理状态之间的内在依赖,导致表征碎片化、推理不稳定。为应对这些挑战,我们提出基于ToM的说服性对话(ToM-PD)任务,其以信念-愿望-意图(BDI)框架为基础,显式建模多轮对话中心理状态之间的序列依赖。为促进该任务的研究,我们构建了大规模标注数据集ToM-based Broad Persuasive Dialogues(ToM-BPD),刻画细粒度心理状态及相应的说服策略。我们进一步提出Think Thrice Before You Speak(TTBYS),一个知识增强的逐步推理框架,同时利用显式与隐性两类先验经验改进LLM对愿望、信念和说服策略的推断。实验结果表明,配备TTBYS的Qwen3-8B在预测愿望、信念和说服策略上分别超越GPT-5达1.20%、22.80%和16.97%。案例研究进一步表明,我们的方法增强了推理的可解释性与一致性。

三思而后言:面向说服型智能体的双重知识增强心智理论推理:论文配图
图 3:ToM-PD(左)和 TTBYS 框架(右)概述。在ToM-PD任务中,说服者从对话历史中依次推断被说服者的心理状态,包括意图、欲望和信念,然后根据推断的状态选择合适的说服策略。 TTBYS 通过三个明确的推理步骤来操作这一过程,每个步骤对应于心理状态推理的一个阶段。