论文
LLM 代理的通信理论框架:成本感知自适应可靠性
A Communication-Theoretic Framework for LLM Agents: Cost-Aware Adaptive Reliability
摘要
基于 大语言模型 (LLM) 构建的代理依赖于一系列可靠性技术,包括重试、多数投票和自我一致性,这些技术是并行开发的,而不是在通用分析框架内开发的。我们观察到,在香农编码理论意义上,在温度 $T$ 下采样的 LLM 是一个离散随机通道 $p(y \mid x)$,并使用这个恒等式作为基于通信理论的框架的入口点。这些技术中的每一种都是六种经典可靠性算子之一的特例:多样性组合、混合重传、迭代生成器批评解码、无速率采样、结构化冗余验证和难度自适应路由。在该框架内,我们给出了两个封闭形式的结果:噪声方差阈值,高于该阈值均匀平均优于质量加权平均,以及用于生成器批评细化的收缩性标准,与我们在 3B 和 14B 参数模型之间观察到的收缩到发散的转变一致。我们进一步引入了一种成本感知的语义最近邻路由器,其单个拉格朗日旋钮无需重新训练即可穿越质量成本边界。在涵盖 69 个硬任务的本地和云模型的六种渠道配置中,没有固定的模型-技术-预算选择占主导地位,从而激励了每个任务的分配。在 MMLU、GSM8K 和 HumanEval 的 300 项硬分割上,我们的路由器占据了完整的经验帕累托前沿:在匹配质量下,其归一化成本比最强的固定技术低 ${\approx}56$\% ;在匹配的归一化成本下,它将质量提高了 ${\approx}7$\%(比单次解码提高了 $26$\%)。这些结果主张将这些可靠性技术整合到由信道编码通知的单个可调层中。