论文
AgentForge:用于学习代理软件工程的沉浸式角色扮演平台
AgentForge: An Immersive Role-Playing Platform for Learning Agentic Software Engineering
摘要
智能体AI越来越多地用于协调软件开发中的规划、实施、审查和测试,但其决策和交互的透明度往往有限。许多此类系统还假设用户可以有效地指导人工智能的决策并验证其输出。这一假设对新手来说是一个特殊的挑战,他们必须同时学习智能体AI如何工作、如何与其有效协作以及如何批判性地评估其输出。为了应对这一挑战,我们提出了 \textit{AgentForge},这是一个沉浸式学习系统,新手在多代理代码修复工作流程中扮演四个软件工程角色之一:任务规划者、补丁作者、代码审查者或测试运行者。在每次练习中,新手扮演他们选择的角色,而人工智能代理则扮演剩下的三个角色。通过基于角色的脚手架和元认知支持,AgentForge 明确了特定于角色的职责,使代理协调和中间工件可见,并鼓励新手监控和评估他们的决策。在一项针对 37 名新手开发人员的研究中,参与者在 AI 代理的支持下实现了很高的任务完成率。然而,不同实践之间的交互需求存在显着差异:Code Reviewer 实践需要更多的交互轮次、重新路由和完成时间 ($p_{\mathrm{adj}} = .004$),并且被认为是最具挑战性的。尽管如此,参与者仍表示他们对软件修复和代理协作的理解有了显着的提高 ($p_{\mathrm{adj}} < .001$)。这些发现表明,AgentForge 可以帮助新手培养实用的软件工程技能,同时学习如何更批判性、更有效地与代理 AI 进行协作。