论文

从缺陷报告到浏览器复现步骤:用于Web GUI缺陷复现的LLM智能体

From Bug Reports to Browser-Executable Procedures: An LLM-Driven Agent for Web GUI Bug Reproduction

智能体系统Agent 架构与控制循环

摘要

从自然语言错误报告中重现 Web GUI 错误对于软件维护至关重要,但仍然很困难,因为报告通常缺乏依赖项和输入文件等先决条件。现有的错误重现技术主要针对代码单元或移动应用程序,缺乏针对 Web GUI 的端到端可视化执行和验证。我们提出了 ReBug,一个上下文感知代理系统,它通过驱动真实的浏览器来重建、执行和验证来自 Web GUI 错误报告的浏览器级再现过程。 ReBug 将复制分为两个阶段。在准备阶段,ReBug 从报告和可用工件中重建缺失的先决条件,并生成高级复制计划。在执行阶段,它在浏览器中执行工具介导的交互,维护页面状态和操作历史记录的结构化摘要,并根据从报告得出的预期验证最终状态。我们根据来自四个开源 Web 应用程序的 667 个真实错误报告来评估 ReBug。在受控的当前部署中,ReBug 的性能优于两个基线,平均 RSR 为 49.96%,平均任务完成率为 74.96%,平均操作执行成功率为 86.54%。我们的结果表明,显式上下文重建和状态感知浏览器执行有效地支持报告派生的浏览器再现,而历史重放表明,成功的过程通常会在恢复的有缺陷版本上暴露原始存在缺陷的行为。