论文
LLM代理团队中的环回权威:扁平化和层级化协调的配对实验
Loop-Back Authority in LLM Agent Teams: A Paired Experiment on Flat and Hierarchical Coordination
摘要
分层编排是生产多代理 LLM 框架中的默认协调模式,其中 Manager 代理审查工作人员输出并将其发回进行修订。经典组织理论预测,权威链接会加速决定性产出的收敛;关于阿谀奉承和思想堕落的研究预测,权威批评会使大语言模型的产出更差。之前的比较改变了具有可检查答案的任务的整个框架,使得权威链接在开放式工作中未经测试。我们提出了一项配对实验,其中有五个 LLM 代理人,他们的角色、提示、工具、模型和数据是固定的,并改变一个链接:经理是否可以拒绝工人的输出并要求修改。在 43 个配对产品和 86 次商业智能报告任务运行中,五模型评审小组和确定性规范检查对每份报告进行评分。扁平化组织在实用性(d = 0.42,p = 0.009)和写作清晰度(d = 0.34,p = 0.030)方面得分较高;经典的预测失败了。报告的长度相同,但分层报告的对冲多了 53%,每个修订循环都与写作清晰度下降 0.14 点相关,并且分层的 Writer 的初稿与平面报告没有区别:差距在修订循环内打开。两个组织的规范准确性都达到了上限,并且监管层的词元成本增加了 51.5%,但质量却没有提高。当监管者能够验证时,它就会为自己付出代价;而当它只能提出意见时,它就会成为一种责任。