技术实践

OpenAI内部产品团队用Codex跑通零手写代码的Agent优先工程流程

智能体系统Agent Harness

概述

OpenAI一个内部产品团队进行了为期五个月的实验:构建并发布一个零行手写代码的内部beta产品,应用逻辑、测试、CI配置、文档、可观测性与内部工具全部由Codex编写,产品已有内部日活用户与外部alpha测试者。工程流程上,人几乎只通过提示词与系统交互:工程师描述任务、运行Agent并让它开PR;Codex先本地自审,再请求多个Agent评审并按反馈迭代,直到所有评审Agent满意。为让Agent在可预期的结构里工作,团队把业务域固定分层、严格校验依赖方向,并用Codex自己生成的自定义linter与结构测试做机械约束;约100行的AGENTS.md只充当指向更深层文档的地图。披露结果(团队估算口径):五个月约1500个PR由3名、后增至7名工程师驱动,人均每天3.5个PR,整体耗时约为手写的十分之一;此前团队每周五花掉20%时间清理低质量产出。边界:效率为团队自估算而非独立基准;项目为官方所称实验,处于内部beta试点阶段,尚未到全量生产。