论文

用契约对大模型智能体进行符号时序监督

Symbolic Temporal Supervision of LLM Agents Using Contracts

智能体系统Agent 动作执行与治理

摘要

工具增强的大语言模型智能体通过工具调用操作外部系统,能自动完成网页导航、代码生成和工作流编排等复杂多步任务。然而,模型幻觉、分布不稳定、对抗操纵以及某些工具调用的不可逆后果可能造成危害。现有防护要么事后用随机性大模型评审轨迹,要么逐调用阻止不安全动作,没有单一确定性产物同时支持两种角色。我们提出基于契约的符号时序监督框架ContrAgent,将智能体行为记录为工具调用序列,并形式化为固定可检查谓词集合上的轨迹,再用有限轨迹线性时序逻辑LTLf中的假设—保证契约规定必要行为。每份契约编译成确定有限自动机DFA,同时在线门控动作和离线评估记录轨迹。契约库作为可复用知识库独立于智能体模型维护,能用于同任务领域的不同智能体。四个覆盖两种角色的基准显示,ContrAgent与先进大模型评审和规则防护基线表现相当,却能给出确定、可复现的判断,在线模式每次调用延迟还降低数个数量级。

用契约对大模型智能体进行符号时序监督:论文配图
图1:ContrAgent监测LLM智能体与工具之间的工具调用接口。