论文

Adaptive-GEPA:让您的Harness满足不同的要求

Adaptive-GEPA: Make Your Harness Fit Heterogeneous Requests

智能体系统Agent Harness

摘要

GEPA 等反射优化器根据执行跟踪和评估者反馈改进语言模型提示;全程序扩展还可以重写工具和控制流程。在实践中,用户处理相同的端点异构请求,其有效的解决方案需要不同的工具、推理模式和控制流。优化一个共享程序会使这种工作分工隐含在源代码搜索中,而针对每个请求系列优化一个单独的程序则可以预先修复它。我们引入了 Adaptive-GEPA,它可以学习如何划分请求以及如何解决它们。它在一个搜索预算下开发了一个路由器和一个专业程序库。路由器的指令、每个专家的描述及其程序代码都是简单的、人类可读的文本,根据反馈进行编辑。为了合并分支,它根据专家处理的请求来调整专家,并将描述与程序一起继承。在四个任务族的固定混合上,所报告的 Qwen3-8B 运行演化出了四个专家,而不向路由器或反射模型提供族标签;它的路由与所有 651 个测试请求上的任务分区相匹配。其家庭平均测试分数 (x100) 从 52.6 上升到 70.6,而在名义预算为 18,000 个评分呼叫的情况下,GEPA 的全程序适配器为 62.5,GRPO 为 54.0。这些计数并不等于总计算量。图 1 总结了学习曲线、最终测试分数和路由协议。