论文

技能描述 针对代理互联网中的任务路由的欺骗攻击

Skill Description Deception Attack against Task Routing in Internet of Agents

模型评测安全与风险评测

摘要

代理互联网 (IoA) 是一种新范例,正在将网络系统转变为 LLM 驱动的服务网络,其中异构代理根据其自我声明的技能描述通过任务路由进行协作。尽管这种有前途的范例能够实现代理、分布式和高级智能,但它也暴露了一个新的、被忽视的攻击面。特别是,恶意代理可以有策略地操纵其技能描述,以影响路由决策并增加其被选择执行任务的可能性,从而扰乱用户任务并降低系统可靠性。为了描述这种威胁的特征,我们提出并形式化了一种新的攻击模型,称为 \emph{技能描述欺骗} (SDD) 攻击。我们进一步设计了一个支持 LLM 的 SDD 攻击框架,该框架可自动生成欺骗性技能描述,从而实现 IoA 系统的系统漏洞评估。在9个代表性域上的实验结果表明,所提出的攻击可以获得高达98%的攻击成功率,证明了该攻击的严重性和通用性。我们的论文揭示了 IoA 中的一个新的安全漏洞,并呼吁为未来的 IoA 系统提供安全且值得信赖的语义路由机制。