技术实践

字节跳动用Agent Miner开展多Agent安全审计

模型评测智能体系统AI 基础设施Agent 协作AI安全与内容治理基础设施安全与风险评测

概述

针对 LLM 驱动的 AI 智能体因高度自主性与复杂性带来的数据泄露、系统破坏等风险,火山引擎 AI 安全团队推出 Agent Miner——一个基于多 Agent 协作的通用 AI 智能体安全审计智能体。它本身是由多个专业智能体组成的协作网络,把复杂安全审计任务分解给不同角色:有的负责规划,有的负责静态代码分析,有的负责动态风险验证。 其核心是「动静结合的闭环审计」:先由静态分析扫描代码发现潜在风险点,再由专门的「风险验证官」智能体编写并执行攻击代码(PoC)做动态验证,以「先发现线索、后证实威胁」的自动化流程提高漏洞发现的准确性与效率。基于该框架,团队已在超过 10 个主流开源通用 AI 智能体中发现 15 个以上安全漏洞,并获得 7 个 CVE 编号。 成果于 Black Hat Asia 2026(2026 年 4 月 21—24 日,新加坡)亮相。