论文
治理动作而非智能体:制度性证明作为自主AI系统的治理模型
Governing Actions, Not Agents: Institutional Attestation as a Governance Model for Autonomous AI Systems
摘要
自主AI智能体可能开始执行重大、不可逆的动作——如临床处方与生产软件部署。本文观察到:人类机构治理强大的自主行动者不是通过监视其推理——而是通过在重大动作发生点要求独立证明的证据。我们把该制度模式形式化为AI智能体系统的计算治理模型。在所提模型下——智能体对规划与推理保持完全自主——但对指定高风险动作不持执行权限。执行以各自由独立权威来源证明的前置条件为条件——前置条件被密码学绑定到声明的意图——并由确定性策略评估。决策记录在可独立复核的防篡改日志中。我们呈现概念验证实现——并以软件部署与临床处方为例说明该模型。