论文

代理安全:LLM 驱动的渗透测试的工具、故障模式和设计法则的系统化

Agentic Security: A Systematization of Tools, Failure Modes, and Design Laws for LLM-Driven Penetration Testing

智能体系统Agent 架构与控制循环

摘要

代理安全使用大语言模型 (LLM) 代理来规划、调度和解释安全工具。随着这些系统从演示转向已部署的产品,从业者不断遇到相同的操作故障。我们通过对十种广泛使用的无人值守管道的静态、动态、云、编排和人工智能红队工具的实际评估,将这些失败系统化。我们引入了四维集成摩擦指数,将一次性工程成本与经常性组织、法律和维护成本分开。然后我们得出解释重复出现的故障模式的定量规律。将代理安全系统建模为由确定性调解器包装的随机 LLM 策略,我们表明,长期会话会丢失带有阶段计数的常驻证据,而短期子代理则根据原始证据与其摘要之间的压缩比来扩展可用范围。我们表明,两阶段的判决级联可以使记分器似然比成倍增加,但当记分器错误相关时几乎没有什么好处。我们表明,将不可评估的结果视为攻击失败会使下游测量偏向于逃避和严重的响应。我们将规划器与工作器模型路由制定为背包问题,并导出重尾工具的封闭形式执行上限,eta* = alpha v/c。最后,我们展示了为什么范围和预算执行不能委托给系统提示:提示并不限制实际执行的内容。 Inspectra 是我们实施的平台,作为一个有效的实例,其机制标记为已发货、部分或计划中,包括那些不起作用的机制。