技术实践

Anthropic以运行环境隔离、凭据外置和出口控制约束Agent权限

AI 基础设施智能体系统Agent 动作执行与治理Agent HarnessSandboxAI安全与内容治理基础设施Agent Sandbox

概述

Anthropic在官方工程文章中梳理Claude产品的三类隔离设计:服务端临时容器、本地受控进程沙箱以及虚拟机工作空间。文件、网络、凭据和工具调用分别受运行环境或代理约束,生成代码不应与高权限控制组件共享相同权限。 安全复盘发现,项目配置在用户确认信任之前被处理,以及通过允许访问的域名使用攻击者凭据发起请求,都可能绕过原先预期的边界。修订包括延后处理未信任配置、对允许域名中的请求身份进行检查,以及将凭据保留在隔离环境之外。虚拟机隔离也会减少宿主安全工具对内部执行的可见性,需另提供事件日志。 文章发表于2026年5月25日,所述事故与修订发生在不同时间;本条按披露日归属,不把这些机制全部视为当天首次出现。