论文
忠实而非纠错:多跳智能体接力中消息格式效应依赖层级
Faithful, Not Corrective: Message-Format Effects in Multi-Hop Agent Relays Are Tier-Dependent
摘要
当LLM智能体互相交接信息时,消息格式重要吗?两支文献意见相左:格式优化工作报告结构化消息在不损精度的情况下削减成本;格式限制工作发现强加结构损害生成——两者都没测量消息跨多跳传递时发生什么,而那里占主导的是复制保真而非一次性生成。我们引入受控接力试验台:十二条程序生成的原子事实简报以五种格式(自由NL、精度指令NL、JSON、三元组、键值)逐跳重编码六跳,由固定强评分器对照程序化真值打分;跨两个接力能力层级、认知负载条件与成对分叉错误注入。发现:消息格式效应依赖层级。(i) 忠实接力指令下,强接力近乎无损——文献记载的“传话游戏”崩塌没有发生;逐跳加认知负载使格式级保真不变(±1.8分内)而生成成本上升24–53%。(ii) 弱(1.5B)接力下,六跳召回的跨格式差距扩大8.7倍(2.3到20.5分):由刚性格式的编码代价与固定键JSON模式特有的抗漂移两种相反机制驱动,格式排序在传递中被翻转。(iii) 成对分叉注入中,注入的错误值一旦出现就在每种格式的83–100%链中持续到最后一跳,与各格式对真值的保留 closely 一致,对相邻事实无附带损害。结构买到的是忠实、可定位错误的通道——不是纠错码;格式选择应跟随管线中最弱的接力者。