论文
AgentGUI:用于观察和指导长时间运行的 AI 代理的界面
AgentGUI: An Interface for Observing and Steering Long-Running AI Agents
摘要
人工智能代理越来越擅长处理复杂、长时间运行的任务。随着自主能力的快速增长,由于以人为本的接口有限,人类监督系统性地滞后。为了解决这个问题,我们引入了 AgentGUI,这是一种用户友好的本地托管 GUI,用于在多个并发、长时间运行的会话中无缝观察和引导 AI 代理。 AgentGUI 具有 1) 丰富的代理轨迹可视化功能,2) 有效的手动和自动转向,以及 3) 与开源和前沿代理框架的集成和协调。一项受控用户研究表明,从代理痕迹中识别关键元素所需的时间显着减少(快 38%,p = 0.023)。在初步实验中,AgentGUI 的自动漂移预防功能在 0.8B--9B 模型阶梯(每个模型 N=50 次运行)中将小型本地代理的任务完成率提高了高达 34pp。 AgentGUI 可通过其项目网站 (https://agent-gui-project.github.io) 和开源存储库 (https://github.com/eth-medical-ai-lab/agent-gui) 以及演示视频 (https://youtube.com/watch?v=GSDyxN1gTF0) 公开获取。