腾讯云以生命周期治理和批量编辑优化Devflow
概述
轻量云团队的多 Agent 工作流 DevFlow 让需求依次经过方案设计、开发、代码审查、测试验证、知识沉淀与汇总,运行中发现成本瓶颈不是代码本身而是长上下文在多轮请求中被反复携带:某次 Developer 完成前期调研后窗口已达约 120K tokens,后续四处修改若拆成四轮请求,每轮都要重新携带这份上下文。 优化沿两条主线展开。一是控制信息进入上下文的时机与驻留范围:把代码探索委托给只读、不加入常驻 Team 的临时 Code Explorer,优先用代码索引缩小范围、限制搜索与读取次数和单文件片段长度,只返回不超过约 500 字的结构化摘要,原始搜索结果随临时 Agent 生命周期结束退出。低频模板改为渐进式加载(Developer 主 Prompt 只留路径、触发条件与流程骨架,实现验证完成后再读 developer-deliverables.md,Skill 的详细模板与边界规则下沉到 assets/、references/)。 正常成功路径改为 Architect→Developer→Code Reviewer→Test Engineer→Knowledge Engineer→Leader 直接流转,Main 只保留失败、重试、人工门禁、协议异常与完成五类场景。二是把已能同时确定的动作合并提交:Prompt 要求无数据依赖的 Read/Write/验证在同一轮模型响应中提交(响应级批量)。 并自研 replace_batch 把原生 replace_in_file 向量化,一次调用携带多个多行 old_str/new_str,基于调用开始时的原始快照定位、要求每个 old_str 恰好匹配一次且区间不重叠,全部读取与校验→staging→检查并发变化→统一替换→失败按快照回滚,配合 PreToolUse Hook 引导使用并在 MCP 探活失败或 2 秒超时时 fail-open 降级。 实测选取业务中涉及 6 个 HTTP 接口改造的真实中大型需求:Claude Opus 5 完整流程 Token 下降 25.69%,Developer -26.58%(约 6.05M→4.44M)、Test Engineer -35.05%(13,374,768→8,687,274)。GLM 5.2 优化前后各跑两轮取平均,完整流程下降 41.95%,Developer 6.23M→2.31M(-62.94%)、Test Engineer 5.11M→2.53M(-50.47%)。