论文

针对存储库规模问题的基于角色的多代理代码生成的评估

An Evaluation of Role-Based Multi-Agent Code Generation on Repository-Scale Problems

智能体系统Agent任务评测

摘要

基于角色的多代理代码生成旨在使 LLM 更有效地解决存储库规模的问题,而不仅仅是小型编程任务。我们在 12 个 Java 存储库上评估了这种方法,发现与单个 LLM 相比,与开发人员代码的相似性更高,但与人类实现之间存在持续的差距。