论文
PACE:计算机使用智能体何时编译
When to Compile a Computer-Use Agent? Measuring Payback and Making Compilation Decisions for Token Efficiency
摘要
把智能体反复执行的GUI过程编译为程序可降低其token成本。但度量回本与决定何时编译有两个挑战:一是编译成本不确定——尝试可能需要修复仍失败;二是未来复用未知——任务可能不再到来或GUI漂移使程序失效。为此我们提出PACE(回本感知的经验编译),包含测量协议与在线编译算法:测量协议记录成功与失败的编译成本,在匹配任务输入上比较智能体与程序执行成本以估计每次使用节省与回本次数;在线算法基于过往任务到达与编译结果,把估计的未来节省与编译成本(含失败尝试)比较,并在允许任一动作前对照由观测任务到达决定的累计预算核查执行与编译支出。在声明的动作成本假设下,每次到达后的总成本至多为全程用智能体执行成本的(1+ε)倍。成功编译的估计回本次数(不含源智能体运行)为2-16次。在使用录制任务到达的仿真中,PACE相对ReAct降低17.3% token成本、相对AutoRPA适配降低24.9%、相对ToolPro适配降低17.3%(ε=0.25)。