论文
迷失地图:语言模型中的对话状态和行为可靠性
Lost with a Map: Conversational State and Behavioral Reliability in Language Models
摘要
面向任务的对话需要轮流维护和更新信息,但语言模型没有暴露明确的信念状态对象。我们研究了 MultiWOZ 和 SGD 上四个系列的八个指令调整语言模型中对话状态的表示、更新和使用方式。结构和值是分开的:哪些域、槽和请求处于活动状态,在模型执行之前是线性可读的,而精确值在用户指定的位置更容易读取。用户更改值后,这两个值在提及时仍然可以访问,并且因果干预表明这两个值都会继续影响模型的操作。在自然闭环交互中,查询失败分为结构支持薄弱、值解析不正确以及未能部署其他支持的约束的情况,而有针对性的干预措施会在这些情况下产生系统不同的修复行为。这些发现激发了状态动作控制器,该控制器从基本模型动作开始,并使用结构读数有选择地对其进行编辑,而不需要完整的预测信念状态作为中间表示。在跨五个模型的持续 MultiWOZ 交互中,它将基本模型精确查询精度从 0.318 提高到 0.621,将任务成功率从 0.272 提高到 0.371,而增加的成本可以忽略不计。总体而言,可靠的交互不仅需要保留对话信息,还需要解决当前适用的可用约束并确保它们控制操作。