论文

带任意时有效证书的自进化智能体

Self-Evolving Agents with Anytime-Valid Certificates

智能体系统Agent Harness智能体自我改进

摘要

自演化智能体违背多数学习理论保证背后的假设:数据、评估器、组件与假设空间都由被更新的策略产生。我们提出SEA——一种架构——将自我修改限制在冻结基座模型周围的小型转向适配器与版本化测试框架内——每次修改仅经任意时点有效的门准入——该门针对固定错误预算发出可审计证书。五个循环控制器组合已发表的保证;由于此类门只能在冻结基座已产生的行为中选择——五个验证器在环机制——best-of-N、微步搜索、自著复现神谕、搜索层控制与自修复——仅凭问题文本计算门所需的密集、免评分器信号。在跨四个基座模型的52实例SWE-bench Verified子集上——基座能力是主导且无混淆的效应;在两个强基座模型上——刻意设计的空操作复合对照将该套件的贡献分离为+4与+5(GLM 5.2从24到28;GPT从29到34,最佳65%),事件日志确认其机制被触发并阻止回归。结果为昂贵评估上的单次运行;确认运行间方差与适配逐任务算法组合是未来工作。