论文

为什么 Git 是代理开发生命周期的内存解决方案

Why Git Is the Memory Solution for the Agentic Development Lifecycle

上下文与知识记忆Agent记忆

摘要

编码智能体 现在生成的团队代码的份额越来越大,而每次更改背后的推理(权衡的替代方案、发现的限制、拒绝的方法)都被困在助理记录中,这些记录随着会话而消失。这种设置的内存,即代理开发生命周期(ADLC),通常被视为一个检索问题并构建为机器:分层存储、内存图、编译的维基、模型判断的准入。我们认为内存应该是 git 绑定的——内置于存储库的版本控制中,继承机器努力构建的保证:来自提交的 真值、来自重建的新鲜度、来自合并的验证、来自审查的遏制。在这个账本上,我们分别解决两个问题,然后将它们结合起来。种子供应是在预先注册的船舶学科下作为八语料库检索研究而关闭的:五个导入的排名机制被拒绝,两个被保留,最佳配置约为 0.31 池化 MRR——约 60 倍的原始转录本 grep 层,约 15 倍的诚实解析转层。答案组装是排名不再有帮助的地方:对于真正的开发人员问题,单次检索得分仅为 0.07-0.20 的答案充分性,而未门控的情节注入会显着降低好的答案。路由器将广度分配给 git 锚定的结构图,将查找指向置信门控事件,并将基本原理分配给决策综合,从而重建单个会话不包含的原因弧(在年轻的约 50k-LOC 生产系统上为 0.83 充分性)。路由后,系统每个问题回答 382-980 个标记,比历史记录低三个数量级。由于 真值 是从提交会话链接中挖掘的而不是注释的,因此每个结果都可以以零标签成本在任何用户自己的历史记录中复制。剩下的约束是捕获。代码、基准测试和论文来源:github.com/rekal-dev/rekal-cli。