论文

谁审计谁、基于什么底座与证据?智能体AI的分级独立性审计协议

Who Audits Whom, on What Substrate, with What Evidence? An Independence-Graded Audit Protocol for Agentic AI

模型评测安全与风险评测

摘要

智能体AI系统会规划、调用工具并在有限监督下行动,既是审计对象,也越来越多地充当审计者。作为保证基础的独立性仍被二元化处理。我们主张沿三个正交轴分级:主体独立性,即谁控制审计者;底座独立性,即共享被审计者基础模型家族、工具链或防护的审计者可能一同失败;证据独立性,即证据能否被证明而非仅自报。每个维度都有先例,本文贡献在于对一次审计同时评定三者,以最弱环节汇总,并在审计者本身是智能体时应用同一规则。我们从可靠性工程移植共同原因失效的beta因子模型,提供形式化基础、输出可由第三方核验的七步协议、对采购控制智能体在三个等级下被审计的结构性可检测性分析,以及模型的蒙特卡洛研究。研究中,传统内部审计配置——真实审计团队、第二个智能体及供应商日志——只发现其原则上可见故障的5.9%,并在一半故障类别中完全未发现问题。我们将三维体系映射至修订后的欧盟AI法案、ISO/IEC 42006、英国公共部门风险管理指南与审计监管实践。