技术实践
字节跳动将分层安全治理沉淀到AgentSentry
概述
正文明确 AgentSentry 本次发布与升级能力并非孤立功能点,而同属一套完整安全体系,且该体系是字节跳动内部 AI 安全治理最佳实践。体系按企业智能体建设阶段与安全需求程度分为三个阶段:L1 智能体基础安全防护(解决智能体安全上线)、L2 智能体精细化管控(解决运行过程中可控)、L3 智能体安全持续运营(解决规模化后能否持续运营机密可信),形成从「基础防护」到「体系化治理」再到「可持续运营」的完整防护路径。 配套的《智能体安全能力图谱》系统性梳理了 AgentSentry 在智能体安全建设的 10 大能力维度与 60 项核心技术要素。该体系面向研发侧 Coding Agent、业务侧 Workflow Agent、员工侧数字员工 Agent 等全类型 Agent 一致下发策略,完成上线前看清资产、运行中管住行为、风险发生后追溯还原的全生命周期防护。