论文
共识在战略上不足:推理踪迹分歧作为价值负载任务的信号
Consensus is Strategically Insufficient: Reasoning-Trace Disagreement as a Knowledge-Representation Signal
摘要
多代理系统通常旨在通过投票、共识协议、辩论或容错聚合来减少分歧。我们认为,这个目标对于充满价值的任务来说是不够的,在这些任务中,分歧可能反映了真正的规范不确定性,而不是代理错误。基于先前关于人类与人工智能协作调节中推理轨迹分歧的工作,我们提出了一个知识表示层,其中推理轨迹和代理决策被抽象为符号分歧状态。给定产生显式推理轨迹和二元决策的智能体,我们根据推理相似性和结论一致性区分四种状态:收敛一致、发散一致、收敛分歧和发散分歧。这些状态支持可废止的战略路由规则。我们在内容审核中实例化了该框架,并认为分歧感知路由为多智能体战略推理的子符号 LLM 审议和符号知识表示之间提供了一座桥梁。