论文

先获取、后探索:在持久工作区中分离搜索Agent的选择与提取

Fetch-then-Explore: Decoupling Selection from Extraction over a Persistent Workspace for Search Agents

上下文与知识记忆Agent记忆

摘要

搜索代理现在能回答需要数十次搜索才能解决的问题,但如何让这些代理阅读页面却很少受到关注。几乎所有代理都使用两种文档界面之一,且两者都将页面与打开时绑定。**“访问并阅读”**在检索时间点将页面的阅读注入消息历史,从而在代理知道需要什么之前固定阅读。**“状态化浏览”**则在页面被提取时从页面中提取证据,但一次只处理一个页面,并在代理打开另一个页面后释放它。无论哪种方式,如果一个在后续多次访问中变得重要的页面需要被检索和渲染,那么它就必须被检索和渲染。我们提出**“检索后探索”**,它将页面选择与证据提取分开,并保留选择的页面:页面记录在文件系统上的每个问题工作区,而不是上下文窗口或临时会话,证据则在需要时从页面中提取。选择变得几乎免费,证据提取可以在代理知道需要什么时等待,并且随着其假设的增强可以重复,页面不会在代理移动到另一个页面时释放,因此证据可以在轨迹上累积。在与固定搜索的统一ReAct harness上,我们比较“检索后探索”与片段基线、访问并阅读以及浏览基线在两个公开网页基准(BrowseComp和WideSearch)上的表现,无论在哪个代理后端,它在所有后端上都领先于BrowseComp,且在WideSearch上通常与或超过基线表现相当。行为分析追踪到工作区定义的移动:离开页面后返回,代理比任何临时界面都更频繁地这样做,因此第一次访问错过的信息仍然可以在稍后恢复。