论文

搜索引擎从不说不:当检索工具拒绝时,Frozen 智能体如何反应

Search Engines Never Say No: How Frozen Agents React When the Retrieval Tool Refuses

上下文与知识检索增强

摘要

搜索工具永远不会说“不”:即使索引没有答案,它也会返回前 k 个段落,因此智能体会看到不相关的文本而不是丢失信号。我们询问当工具拒绝时冻结搜索智能体会做什么。在索引孔测试台上(257 个 NQ 和 300 个 HotpotQA 问题在 21M 通道 BM25 索引中运行,有或没有黄金通道),七个智能体收到五种拒绝措辞之一。未经宣布的一句话拒绝将 Qwen3-8B/32B 中无法回答问题的平均弃权率从 23% 提高到 97%,Claude Haiku 4.5 的弃权率从 28% 提高到 57%,几乎一对一地减少错误答案,平均比系统提示指令高出 51 分。 Search-R1忽略拒绝并伪造检索; Claude Sonnet 5.5 和 Opus 5.5 从记忆作答(弃权+2 分)并遵守系统提示指令(+16)。我们还发现措辞很重要:解释胜过简单的token;观察中的指令对于俳句来说是决定性的;软弱的警告是没有用的。现实的触发器,从轻量级的基于分数的预测器到LLM视觉定位判断器,都远远达不到预言机,并且都落在收益与信号质量曲线上,该曲线以固定的错误拒绝预算对召回率的任何触发器进行定价:对于合规的智能体,瓶颈是工具内部的检测器,而不是智能体,并且该曲线告诉未来检测器的每个点的工作原理召回率值得。