论文
MAVEN:具有逐步认知审计的多代理验证细化网络
MAVEN: Multi-Agent Verification-Elaboration Network with In-Step Epistemic Auditing
摘要
虽然显式推理轨迹增强了模型的可解释性,但现有的范式通常依赖于缺乏中间验证的整体链,从而导致早期错误不受控制地级联。这种模块化的缺乏阻碍了精细的审计,并损害了高风险应用程序所需的认知信任。我们提出了 MAVEN(具有逐步认知审计的多代理验证精化网络),这是一个受黑板启发的框架,旨在通过显式的角色解耦将 LLM 转变为深思熟虑的推理器。 MAVEN 的核心是一个对抗性的怀疑论者-研究员-判断循环,通过在功能上将逻辑防御与事实依据分开来模拟专家审议。 OpenBookQA、TruthfulQA、HALUEVAL 和 StrategyQA 基准测试表明,MAVEN 在四个细粒度指标上提供了卓越的推理质量。值得注意的是,MAVEN 通过生成显式结构化、模块化和可验证的审议轨迹,而不是依赖隐式内部状态或事后共识,始终优于 GEMINI-3.1-Pro 等潜在推理模型和基于共识的基线(例如 ReConcile)。此外,综合评估证实,MAVEN 完全与模型无关,可以作为强大且可转移的推理助推器,在不同的骨干模型上产生显着的性能改进。