论文
LLM 编码智能体 的确定性控制平面
A Deterministic Control Plane for LLM Coding Agents
摘要
LLM 编码工具授予代理广泛的文件和 shell 访问权限,但引导它们的配置层(规则文件、代理定义、IDE 特定的降价)基本上不受管理。对 10,008 个公共 GitHub 存储库(n=6,145 代理配置文件)的普遍性研究发现,代理配置作为未声明的共享组件传播:10.1% 的跟踪路径是跨独立存储库(分叉调整、阈值无关)的 SHA-256 精确重复,其中 75.5% 的克隆对跨越组织边界。还有两个模式具有指示意义:配置很少被修改(58% 单次提交;0.4 与 0.6 次提交/月,针对 CI/CD 工作流程标准化),并且很少声明权限边界(<1% 的代理配置与 33% 的 Actions 工作流程,n=31 个真阳性)。我们提出了一个位于Harness之上的确定性控制平面,它一对一地映射到这些间隙。 Rel(AI)Build 将代理定义视为托管供应链(SHA-256 内容寻址、HMAC 标记的锁定文件、哈希链审计日志);在 LLM 调用之前强制执行分层权限和攻击衍生的阻止列表;门功能通过阶段状态机工作,具有从需求到文件到测试的可追溯性;将单个规范定义编译为七个 IDE 目标;并通过 Jaccard 相似性检测提示漂移。对注入违规行为的一致性测试确认每个机制都强制执行其规定的不变量;开发人员的成果仍然是未来的工作。该层的治理必须是确定性的且与工具无关——而不是委托给进一步的 LLM 编排。