论文
ReM-MoA:推理记忆支撑智能体混合的扩展
ReM-MoA: Reasoning Memory Sustains Mixture-of-Agents Scaling
摘要
智能体混合(MoA)架构通过把多个LLM智能体组织成分层推理管线改进推理时扩展。但既有MoA变体随深度增加无法维持增益——表现出退化、早期平台或饱和。我们提出ReM-MoA——记忆增强的MoA框架——经两种机制维持扩展:(1) 排名推理记忆——用比较型评审智能体持久存储并排序来自所有层的推理踪迹;(2) 策展多样化记忆路由——让不同智能体接触成功与失败踪迹的不同组合——在传播高质量推理的同时保持探索多样性。我们进一步引入可选的多域评审蒸馏管线——经前沿模型监督改进排序质量。跨数学、形式逻辑、代码、知识与常识五个推理基准——ReM-MoA在深度与宽度扩展上都持续超越先前MoA变体——且优势随深度扩大——确立结构化跨层推理记忆为可扩展多智能体推理的关键缺失机制。
