论文
超越代理工具:多代理系统的跨底层权限
Beyond Agent Harnesses: Cross-Substrate Authority for Multi-Agent Systems
摘要
代理系统在改变工作空间时会保留模型可见内存,而运行时、注册表或批准服务可能会在两者之外保留权限状态。相同的最终文件可能需要相反的安全操作。我们称之为跨底层权限差距:与决策相关的授权信息驻留在规划者可见的工作空间或内存状态之外。在两个受控迷你基准系列中,三个实验使用真实的 Git 谱系、持久记录的代理执行尝试、确定性预言和两个模型路线,将规划器观察增强与执行时权限检查进行比较。实验 1 是 128 单元受控证据消融:权威盲候选证据获得 0/32 最终语义成功,而原始收据和类型化关系均获得 32/32。缺失的权威事实解释了收益;与同等的原始信息相比,打字包装没有观察到计划准确性的提高。实验 2 使用 96 个规划调用:工作区可见证据产生 12/16 不安全的发布决策,并且具有类型化关系的规划仍然不可靠(15/32 第一个操作正确;11/32 无效或不存在)。实验 3 重放相同的 32 个固定模型生成的第一动作意图,且附加模型调用为零;确定性执行防护可防止所有 6 种不安全意图生效,并允许所有 12 种有效的授权发布意图。这些结果将突变边界的权威执行定位为内存治理的操作端点。