论文
延迟验证破坏了多代理 LLM 信念的稳定性:不稳定阈值和最佳校正器放置
Delayed Verification Destabilizes Multi-Agent LLM Belief: Instability Thresholds and Optimal Corrector Placement
摘要
多代理大语言模型(LLM)系统通常依赖验证者和批评者代理来抑制幻觉,但验证会被延迟。在此延迟期间,虚假声明可能会通过代理网络传播。我们将此过程建模为具有接地校正器节点的图上的延迟共识。接地拉普拉斯算子的谱分解产生了验证剂量的封闭形式稳定性阈值:太强或太延迟的校正可能会将共识变成振荡。当通信和验证延迟同时发生时,会出现最不稳定的情况;对于延迟二,阈值是逆黄金比例。相同的框架给出了超模块化放置目标和贪婪(1-1/e)近似规则,用于将有限的校正器预算分配给有影响力的节点。五个开放模型的实验证实了预测的剂量延迟振荡。相比之下,有证据依据的事实回答使真相成为一个吸收边界并消除了影响,这表明不稳定是有符号信念任务所特有的,而有证据依据的核验仍然保持稳定