论文
长期分裂的帝国必须团结:三个 LLM 智能体装备的架构融合
The Empire, Long Divided, Must Unite: Architectural Convergence in Three LLM Agent Harnesses
摘要
代理工具将语言模型转变为自治代理:构建模型上下文、协调其工具、运行循环并在长期运行中保持状态的周围代码。这一层,而不是它所包装的模型,越来越成为对代理行为的约束。我们提出了一个源代码级的多案例研究,研究了三个基于故意相反的哲学构建的开放编码代理工具:LangChain 的 deepagents(包含电池)、Earendil 的 pi(激进极简主义)和 DeepSeek 的 dsh(一切都是插件)。在固定提交中读取每一个并跟踪其提交历史,我们发现这两个成熟的工具朝着相反的方向发展(深度代理减去创作的脚手架,pi 增加持久的基础设施),但都趋向于一种由五个重复元素组成的架构中间形式:商品化循环、仅附加的可重播会话记录、作为数据保存的模型怪癖、上下文的渐进公开和显式扩展接缝。第三个Harness(后来被解读为保留检查)展示了所有五个,并且在一个接缝中完全重用了另一个接缝的实现。因此,我们不主张独立发明,并将融合分解为并行发现、扩散和文字重用。最后,一个承载维度没有表现出收敛,甚至不存在:外部可验证性,即外部方可以在不信任运行时的情况下检查的防篡改记录。我们将这种缺席视为一种预测差距,而不是一种疏忽,即出处敏感领域的利用的下一个轴将有所不同。