论文

CAVERT:超越记忆正确性的多 Agent 执行一致性

Beyond Corrected Memory: Execution Consistency in Multi-Agent Systems

智能体系统Agent 动作执行与治理

摘要

共享记忆协调智能体的操作,但正确的记录并不能证明这些操作满足任务要求。 记忆治理和故障诊断规范或检查记录信息;它们本身并不能确定判断任务职责是否足够。我们通过管理状态使用、信息移交和最终状态协议的职责来定义执行一致性,并具有用于判断履行情况的明确证据条件。我们的核心主张是,相同的保留记录可以对应于同一任务规则下的合规和违规执行。受控地删除证据(例如收据、行动依赖性或响应有效性)使得 82.4% 的相反标签对无法区分;恢复分离了 97.9% 的合并对。自然对数注释识别实际执行中定义的违规行为。然而,现有的日志并不总是明确地表示这些判断所需的执行关系。为了评估该定义的实用价值,我们使用 CAVERT(一致性诊断和恢复框架)从日志中提取支持的关系并应用这些标准。在所有 12 个基准执行器设置中,它在诊断方面始终优于合同提示的 LLM 和基于规则的基线。在相同的门和执行器限制下,它在所有四个评估环境中也优于规则引导的恢复。这些发现确定了智能体-记忆和执行接口应保留的执行证据,以进行可靠的判断。

CAVERT:超越记忆正确性的多 Agent 执行一致性:论文原图
图1:一项取消义务,撤销后的三项延续(a):履行(b,N),未履行且相关记录完整(c,V)或证据不足(d,U)。