论文

本地化 MCP Agent框架中的 Post-Wire 语义更改

Localizing Post-Wire Semantic Changes in MCP Agent Frameworks

智能体系统智能体互操作协议

摘要

有效模型上下文协议 (MCP) 消息不能保证Agent框架保留下游软件需求的区别。我们提出了一种差异测试方法,该方法通过每个框架的公共接口遵循固定的工具结果,并检查明确的消费者需求。该方法应用于四个固定 Python 集成中的 18 个设计夹具,识别出 13 个独特的夹具任务差异,涉及结构化值、声明的错误和丰富的内容。 Google ADK 满足其观察路径中的每个主要合约;其他集成显示特定于接口的更改或执行失败。更改是否重要取决于消费者:将缺失的可选字段视为等同于 null 解释了 OpenAI 严格的丰富内容失败的大部分原因。在探索性重放中,解析 JSON 文本会恢复更多结构化值,但也会返回错误值和源中不存在的字段的值。记录的设置有助于解决输出压力冲突的情况,而无需恢复单独的结构化槽。故障挑战暴露了预言机的弱点并在新案例上测试其修复。该研究提供了来自受控案例的可重复的、特定于界面的证据,而不是生产故障率或模型行为测量。它的实际含义是,线后回归测试需要指定所需的信息以及消费者如何阅读它。