论文
L-MAD:法律推理中多智能体辩论结构的系统评估
L-MAD: A Systematic Evaluation of Multi-Agent Debate Structures in Legal Reasoning
摘要
尽管多智能体辩论(MAD)框架在通用推理上展现显著潜力,其在高度结构化、知识密集的法律领域的有效性仍未被充分探索。本工作引入法律多智能体辩论(L-MAD)框架:在法律文本蕴含任务内系统评估不同辩论结构与聚合方法。通过为多个智能体指派不同的专家人格,L-MAD比较强单智能体基线最多提升8%。分析辩论规模揭示明确权衡:增加智能体数量降低不一致并提升准确率,而延长讨论轮次诱发有害的“过度深思漂移”——智能体互相强化彼此的错误。最终,我们的发现勾勒出在高风险法律推理环境中部署协作多智能体系统的实践边界与安全边际。
