论文
IndexAct:让 Agent 探索索引状态而非反复接收文本
From Delivery to Stateful Exploration: Rethinking the Index for Agentic Search
摘要
Agentic搜索进步使LLM Agent更精细地控制语料探索,但接口往往在只需候选集合反馈时仍返回匹配段落,将候选细化与文本暴露耦合。IndexAct以索引原生语料交互接口分离候选集细化和文本检查。Agent用词法条件及倒排索引集合操作构建、修改持久候选集,接收可复用状态引用和候选数量等统计,而非匹配段落。反馈指导进一步细化;单独请求的段落提供新线索或证据,用来继续操作已保留集合。在覆盖Agentic搜索和多跳问答的五个基准上,均超过所测基线。BrowseComp-Plus中,相比终端语料接口,以更小平均活动上下文获得更高证据覆盖,并在语料扩展时保持准确率。分析表明,有信息量的细化反馈与状态复用支持持续证据发现,单纯缩短上下文或减少搜索步数并不保证更好表现。
