阿里用分层索引和审批流程管理Spec开发
概述
针对上下文腐烂、审查瘫痪、维护断层、代码不信任四个痛点,团队把大模型编程固化为可复制流程:Spec 是任务级真相源(目标/范围/约束/风险/Checklist),CodeMap 是单项目索引(入口、核心链路、依赖、风险),ProjectMap 是多项目一级导航(涉及哪些项目、调用与数据流、优先看哪些模块、哪些必须改),要求模型先看索引再进入正确局部而非全仓盲扫。 RIPER 审批状态机约束执行顺序与单步粒度,Pre-Research 由 create_codemap、build_context_bundle、sdd_bootstrap 三条命令产出长期资产(mydocs/ 下 codemap 长期资产、context 一次性语料、specs 核心资产),Research 阶段每条结论必须有代码出处,Innovate 强制 2-3 个方案由人拍板,Plan 精确到文件路径与函数签名且看不懂不准动手,Execute 严格按图施工并关闭 YOLO 模式,Review 用 Skill 原生 review_execute 做三轴审查(Spec 达成率、代码一致性 Diff、代码质量与弱点),Archive 沉淀 _human.md 与 _llm.md 双视角资产。 团队只约定一条治理规则「未经 Plan Approved 不得改代码」。协议按轻重双轨:标准版约 3000-3500 tokens(协议主体约 220 行,详细规则从 references 按需加载),轻量版约 800-1000 tokens 并按 Fast/Standard/Deep 自动分流。试点 SOP 为 Day1-2 用老需求试点(核心研发 1-2 小时产出 Code Map、低经验同学按 SDD-RIPER 完成)、Day3-4 复盘调整、Day5-7 换人验证可复制性并扩大范围。 作者称效果来自团队真实交付统计:主语言 Java Bug 率 -18%、非主语言(Go/Python/Node.js)-37%,日常需求周期 1-2 周降至 3-4 天、大型需求 2 个月降至 1 个月、大客户交付人力节省 40%、团队整体效率 +55%,30 天 Token 使用量 10.8 亿、4 个并行窗口、缓存利用率 447x。 已向近 10 个团队/部门完成布道与落地推广,并产品化为 Aone Skill + Prompt Market。