论文

VeriWeave Govern:企业 AI Agent的证据门控确定性运行时治理

VeriWeave Govern: Evidence-Gated Deterministic Runtime Governance for Enterprise AI Agents

智能体系统Agent 动作执行与治理Agent Harness

摘要

企业人工智能Agent越来越多地调用工具、修改基础设施和处理受保护的数据,从而需要将操作生成与操作授权分开。本文介绍了 VeriWeave Govern,这是一个确定性运行时治理层,它根据版本化策略评估结构化Agent操作,验证类型化证据,应用固定拒绝 > 审查 > 允许优先级,将后续操作路由到负责任的人工审核,并记录可重播的防篡改审核状态。 GovernBench 评估了超过 30 个独立种子和 60,000 个预言机标记案例的设计,涵盖五个企业领域、对抗性证据、分布外行动和时间策略演变。 VeriWeave 在评估案例中实现了 0.9888 平均准确度、0.9836 宏 F1、零观察到的聚合错误允许以及零观察到的治理攻击成功率。六项消融表明,证据门控、拒绝优先、分布外故障安全行为、人工审查、矛盾处理和时间重放有助于补充安全性。部署的API还通过了12/12端到端场景和40,040个请求的并发矩阵,零故障。另一项基于欧盟/奥地利法规的 150 个案例评估使用冻结预测和两名独立的盲人注释者,他们同意所有决定。在这组中,确定性引擎仍然保守,而 Gemma 4 31B 比较器更接近人类共识。结果揭示了可衡量的安全性——效用权衡,并激励证据感知、可重玩的治理作为企业Agent执行的独立控制平面。