论文

经积木组合可验证概念模型:迈向智能体AI工作流的设计时验证

Composing Verifiable Conceptual Models via Building Blocks: Towards Design-Time Verification of Agentic AI Workflows

智能体系统Agent 动作执行与治理Agent Harness

摘要

智能体AI系统经协调决策、工具与外部动作的工作流架构编排多个基于LLM的智能体。虽然当前平台强调运行时保障——但在系统设计期间验证工作流的支持很少。从建模与仿真视角——该缺口类似组合概念模型而未验证其积木是否连贯交互。我们提出设计时验证方法——把智能体工作流建模为可复用积木的组合——并经十二条结构规则检查其兼容性。我们在软件原型中实现这些规则——并用两个公开数据集评估:48个带已知设计缺陷的工作流与168个保留工作流逻辑但改变图结构的变体。结果表明我们的验证器即使当缺陷设计经结构变换(如智能体间拆分任务)被遮蔽时——仍可靠检出违例。未来工作可把我们的验证与社区积木库组合——组合安全的智能体工作流。

经积木组合可验证概念模型:迈向智能体AI工作流的设计时验证:论文配图
图 1:Agentic AI 工作流程架构示例。顶点代表分配给角色专用代理的子任务。每个代理执行一个内部原因-行动-观察微循环(橙色箭头)来与工具和环境交互。工作流程依赖关系决定了宏观层面的管道(蓝色实心箭头),以及用于迭代批评的可选工作流程层面反馈循环(蓝色虚线箭头)。