论文
从技能文本到技能结构:智能体技能的调度结构逻辑表示
From Skill Text to Skill Structure: The Scheduling-Structural-Logical Representation for Agent Skills
摘要
大语言模型 (LLM) 代理越来越依赖可重用的技能:结合了指令、控制流、约束和工具调用的功能包。然而,在当前的代理系统中,技能仍然由文本密集的工件来表示,主要是 SKILL{.}md 风格的文档,其机器可用的证据仍然主要嵌入在自然语言描述中。因此,以技能为中心的代理系统面临着表示问题:管理技能集合和在代理执行期间使用技能都需要对调用接口、执行结构和具体副作用进行推理,但这些信号通常纠缠在单个文本表面中。因此,技能知识的明确表示可能有助于使机器更容易获取和利用这些工件。借鉴 Schank 和 Abelson 关于认知语言表示的经典著作中的记忆组织包、脚本理论和概念依赖,我们介绍了据我们所知,第一个代理技能工件的结构化表示,它解开了技能级调度信号、场景级执行结构和逻辑级动作/资源使用证据:调度-结构-逻辑(SSL)表示。我们使用基于 LLM 的标准化器实例化 SSL,并在技能发现和风险评估这两个任务中评估 SSL 派生的表示。实验表明,SSL 显着优于纯文本基线:在技能发现中,MRR@50 从 0.649 提高到 0.729;在风险评估中,宏观F1从0.409提高到0.509。这些发现表明,明确的、基于源的结构可以使代理技能更容易搜索和审查,将 SSL 定位为迈向更可检查、可重用和可操作操作的技能表示的实际步骤,而不是完成的标准或端到端技能管理机制。