技术实践

小红书以分层经验推动测试用例生成与自进化

应用与实践上下文与知识智能体系统知识库Agent 规划Agent 工具调用编程

概述

在造数之后,团队把同一套 Agent 大脑接入自动化用例生成:给定测试同学日常撰写的用例描述(操作步骤、测试项、预期结果,如笔记删除处置),Agent 先做用例需求分析与计划,再走脚本召回——完全匹配直接执行、相似脚本参考编写,最后执行并汇总结果。为提升一次性成功率,经验沉淀分两层:工具级把 Debug 过程中发现的隐性坑(如 price 单位为「分」非「元」、标注「选填」实则必传、文档未列的有效枚举,以及下单返回的 order_id 与支付所需 oid 之间的 ID 转换逻辑)统一写回工具的 toolPrompt,下次调用自动携带。 链路级把成功执行的整条调用链由 Agent 总结为脚本元信息(功能描述/入参 schema/适用场景),脚本入 Git、元信息入向量库,下次相似请求 RAG 召回后完全匹配则秒级复用、部分匹配借鉴其调用组合局部补齐、无匹配走完整 Debug-first 流程并再次入库。团队指出这套取代了传统「原子能力+流程编排」方案——后者维护成本高、灵活性受限,长期只能稳定覆盖约 20% 的高频路径。