技术实践

百度网盘把多路AI审查接入CI/CD准入

应用与实践智能体系统模型评测Agent 协作Agent Harness评测方法与指标编程

概述

百度网盘主端 FE 团队面对每月约 2000 次 CR、AI 生成代码占比约 55.87% 的审查压力,选择把 AICR 嵌入 iCode 提交到 iPipe 检测的 CI/CD 流程。系统先整理 diff、关联文件、调用关系、规则与历史风险,使用三路审查 Agent 从运行时、逻辑、边界和代码质量等方向并行检查,聚合结果后由核实 Agent 反向验证,再由复核 Agent 检查被删除问题以降低漏报。 检测结论回写 iCode 评论并经 n8n 推送如流智能工作卡,用户可反馈误报,团队持续沉淀知识本和纠错本。管线将平均 5 分钟设为审查目标并对各阶段控时,且按代码库密级动态选模。在一周 552 个真实 CR 对照中,GPT5.5 检出 121 条、检出率 21.8%,GLM5 检出 38 条、检出率 6.9%。