论文

架构对于多代理安全至关重要

Architecture Matters for Multi-Agent Security

模型评测安全与风险评测

摘要

多代理系统 (MAS) 由两个或多个自主 AI 代理网络组成,在生产部署中变得越来越流行,但也带来了单代理设置中不会出现的安全风险。即使单个代理表现出强大的安全性,管理其协调的架构决策也可能会创建尚未系统表征的攻击面。在这项工作中,我们对 MAS 设计决策如何影响任务性能和攻击抵抗之间的权衡进行了实证研究。在三种代理环境(浏览器、桌面和代码)和 13 种架构配置中,我们使用分阶段评估来区分计划拒绝、执行阶段拦截、部分有害执行和成功攻击完成,以研究三个关键设计选择:(i)代理角色,决定如何分配权限和责任; (ii) 通信拓扑,它决定代理交互的方式和时间; (iii) 内存,它决定每个代理可访问的上下文和状态可见性。我们发现,在大多数配置中,多代理架构比独立代理更容易受到攻击,在相当或更高的良性精度下,攻击成功率最多可达 3.8 倍,并且没有单一设计是普遍安全的。这些结果推动了进一步评估的发展,超越了单一代理的安全属性。