论文
MemoHarness:从经验中学习的智能体治控
MemoHarness: Agent Harnesses That Learn from Experience
摘要
智能体治控是把基座LLM变成可执行智能体的外部控制层:管理上下文、工具、编排、记忆、解码与输出处理。虽然治控设计强烈影响智能体行为,多数自动改进方法优化更窄的工件——提示、管线或工作流——而部署的智能体通常对所有情况复用单一全局治控。我们提出MemoHarness:一个从自身执行中学习的自适应治控优化框架。MemoHarness把治控分解为六个可编辑控制维度,在双层经验库中存储逐案例诊断与蒸馏的全局模式,并使用检索到的经验把学到的治控适配到每个测试用例——无需测试时标签、反馈或额外搜索。在跨shell智能体、代码生成与分析推理基准的评估中:MemoHarness超过我们对比的固定治控,并展现向未见套件与基座模型的选择性迁移。其附加上下文在大部分检索经验可缓存时也能保持成本竞争力。结果提供证据:执行经验是构建比单一静态配置更具适应性的智能体治控的实用基底——同时把关于统计鲁棒性与组件归因的更广主张留给后续工作。
