论文

IndexAct:让 Agent 探索索引状态而非反复接收文本

From Delivery to Stateful Exploration: Rethinking the Index for Agentic Search

智能体系统Agent 工具调用

摘要

Agentic搜索进步使LLM Agent更精细地控制语料探索,但接口往往在只需候选集合反馈时仍返回匹配段落,将候选细化与文本暴露耦合。IndexAct以索引原生语料交互接口分离候选集细化和文本检查。Agent用词法条件及倒排索引集合操作构建、修改持久候选集,接收可复用状态引用和候选数量等统计,而非匹配段落。反馈指导进一步细化;单独请求的段落提供新线索或证据,用来继续操作已保留集合。在覆盖Agentic搜索和多跳问答的五个基准上,均超过所测基线。BrowseComp-Plus中,相比终端语料接口,以更小平均活动上下文获得更高证据覆盖,并在语料扩展时保持准确率。分析表明,有信息量的细化反馈与状态复用支持持续证据发现,单纯缩短上下文或减少搜索步数并不保证更好表现。

IndexAct:让 Agent 探索索引状态而非反复接收文本:论文原图
图 3:IndexAct 概述。候选探索是在索引中的可重用状态上执行的,其中操作返回状态引用和统计反馈,而无需源文本。当智能体需要新的线索或证据验证时,它会显式读取选定的源文本区域。