论文

深入研究克劳德代码:当今和未来人工智能代理系统的设计空间

Dive into Claude Code: The Design Space of Today's and Future AI Agent Systems

智能体系统Agent 架构与控制循环

摘要

Claude Code 是一种代理编码工具,可以代表用户运行 shell 命令、编辑文件和调用外部服务。本研究通过分析公开的源代码并将其与两个独立的开源人工智能代理系统 OpenClaw 和 Hermes Agent 进行比较来描述其架构,这两个系统回答了许多相似甚至相同的设计问题。我们的分析确定了推动架构的五种人类价值观、哲学和需求:人类决策权、安全性和隐私、可靠执行、能力放大和上下文适应性。然后,我们通过十三个设计原则追踪它们直至实现选择。该系统的核心是一个简单的 while 循环,用于调用模型、运行工具并重复。然而,大多数代码都存在于围绕此循环的系统中:具有七种模式和基于 ML 的分类器的权限系统、用于上下文管理的五层压缩管道、四种可扩展性机制(MCP、插件、技能和挂钩)、子代理委派和编排机制以及面向附加的会话存储。与 OpenClaw 和 Hermes Agent 的比较表明,相同的设计问题在三种部署环境中会产生不同的答案。 Claude Code 强调每次操作的安全性,OpenClaw 强调外围级别的访问,而 Hermes 则在许多表面上提供每次操作的批准。在运行时层,Claude Code 使用单个 CLI 循环,OpenClaw 将运行时嵌入网关控制平面内,而 Hermes 使用一个进程,其角色由其入口点设置。在上下文和扩展层,Claude Code扩展了上下文窗口,OpenClaw注册了网关范围的功能,Hermes提供了可插拔的内存和模型后端。我们最终根据最近的经验、架构和政策文献确定了未来代理系统的六个开放设计方向。