论文

关于 AI Agent 的可审计声明

Auditable Claims about AI Agents

智能体系统Agent 动作执行与治理

摘要

组织对其 AI 智能体进行声明:一个人批准每封外部电子邮件,记录每个操作,评估显示智能体可以安全部署。欧盟人工智能法案第 12 条要求高风险系统允许自动记录事件,但没有说明哪些记录可以解决特定索赔。立场就是一句话:要进行检查,有关智能体的声明必须首先命名其策略、其范围、解决该问题的记录以及编写它们的人。适应鉴证业务的先决条件,当这些要素和决策规则在任何裁决之前得到确定并且可以获得记录时,我们将索赔称为可审计的。这将我们的可审计智能体框架的策略可检查性维度从单一操作扩展到索赔。 智能体增加了三个条件:独立记录的覆盖、每个动作的参数绑定的授权以及超越完整性的完整性。在显式模型下,我们证明,如果没有每个假设成立,那么支持是不可能的。声明检查表将该方法应用于六种常见声明,这些声明植根于当前的 NIST、IETF 和 OWASP 草案中。一个已处理的案例通过五个证据状态来遵循一个主张。最后,我们为操作员、采购员、审核员和标准制定者提供了练习框和步骤。