论文
潜在通道真的在通信吗?潜在多智能体LLM的因果审计
Do Latent Channels Actually Communicate? A Causal Audit of Latent Multi-Agent LLM
摘要
基于大语言模型(LLM)的多智能体系统(MAS)中的潜在通信传输的是连续内部表示而非文本,但更大的表示能力并不能证明接收方确实使用了任务相关信息。仅凭端到端任务表现也无法揭示观察到的效应究竟取决于消息的存在、为被评估样例生成的内容,还是由另一个智能体提供的信息。我们引入一种因果审计,在发送方产生的表示进入接收方的边界处施加受控消息替换。四种消息设置支持五项测量:编码的发送方信息、接收方对消息存在与身份的敏感性、样例特定内容的任务价值,以及由另一个智能体提供的附加价值。我们将该审计应用于Qwen3-4B和Qwen3-8B在GSM8K、ARC-C和MATH-500上的潜在中继(latent relay)。在GSM8K上,Qwen3-4B的-1.00个百分点总体性能效应可分解为其他样例消息保留的-6.17点效应和可归于样例特定内容的+5.17点效应;两个分量的方向在8B上均发生反转。在MATH-500上,Qwen3-4B的15.00点增益包含其他样例消息保留的8.33点和可归于样例特定内容的6.67点,而8B的增益主要由前者构成。自替换比较进一步表明,样例特定内容与其他智能体价值是彼此不同的。这些结果表明,总体准确率无法识别潜在消息如何影响接收方,并促使将受控消息比较确立为潜在通信的标准评估手段。
