论文

从提示到契约:面向可审计企业LLM智能体的治控工程

From Prompts to Contracts: Harness Engineering for Auditable Enterprise LLM Agents

智能体系统Agent Harness

摘要

企业LLM应用常始于行为由提示与检索上下文承载的原型。产品化增加了对来源边界、实体路由、答案契约与可复现痕迹的要求。我们呈现治控工程方法:把该模式重构为可追溯、可审计的LLM智能体架构——确定性行为移入围绕可替换组合边界的代码、清单、模式与验证工件,而源支撑的论断仍是运行时答案的权威。我们在五个韩国企业集团(25家上市公司)的公开数据切片上实例化,并评估三个研究问题。(1) 治控在固定验证场景中保持其来源落地、实体路由、痕迹、输出卫生与推荐语言契约;故障注入对照确认验证器会标记故意破坏的契约。(2) 治控强制执行的检查在模型替换下成立:跨三个托管模型在全部270次组合边界运行中通过;失败仅限于模型组合侧并被捕获记录。(3) 代码拥有的保证是承重的、不能仅靠提示复现:固定模型只变执行层——仅提示指令会让推荐语言与内部痕迹泄漏违规到达读者,而治控完全阻止。外挂外部护栏也能阻止此类违规但过度拒绝——效用降至88/120,而治控保持完整效用(120/120);该消融中只有代码拥有的执行同时保留安全与效用。结果是可复用的工程模式:把探索性原型变成带版本化来源、控制与验证工件的、可审计的应用。

从提示到契约:面向可审计企业LLM智能体的治控工程:论文配图
图 5:执行层消融的运行时利用流程。用户问题由运行时合格的源支持的声明(顶部管道)进行路由、规划和组成;然后,在面向读者的验证检查之前,实时合成路径会分支为三个强制条件。只有harness分支是生产路径; Prompt-only 和 external-guardrail 是由 enforcement-condition 参数选择的仅消融基线。左侧分支(无 LLM 提供程序)是确定性重播基线,而不是第四个条件:表 8 仅在提供程序配置的实时分支上改变执行层。