论文

面向通用智能体的构造式治理

Governance by Construction for Generalist Agents

智能体系统Agent 动作执行与治理Agent Harness

摘要

企业智能体被越来越多地期望能够跨工具与接口自主运行,而生产部署要求治理内建于构造之中。系统必须明确规定允许哪些操作、何时需要人工监督、哪些信息可以暴露,且无须为每个领域重建智能体。本演示展示 CUGA 的策略系统,这是一个模块化的策略即代码层,与通用 LLM 智能体组合,在无需模型微调的情况下于复合工作流中提供可预测、可审计且合规感知的行为。我们提出一种运行时治理架构,在执行的每个关键阶段强制实施策略干预。策略并非被动约束行为,而是在五个结构性检查点拦截智能体:规划上游(Intent Guard)、系统提示内部以引导推理(Playbook)、工具调用边界以强制正确使用(Tool Guide)、推理循环之外作为针对高风险操作的人机协同门控(Tool Approvals),以及输出阶段对最终响应进行过滤与结构化(Output Formatter)。这些阶段共同将治理持续嵌入智能体的执行流水线,而非事后补加。演示通过医疗场景与多层执行干预,展示了用于结构化工具序列约束的动态剧本注入、拦截恶意或意外有害请求的意图防护,以及针对潜在破坏性操作的人机协同工具审批检查点。该成果展示了类型化治理原语如何助力企业智能体系统更快、更安全地部署,同时提升策略遵从性与执行一致性。