论文
迈向智能体技能的系统基础:架构、生命周期与安全
Towards a Systems Foundation for Agentic Skills: Architecture, Lifecycle, and Security
摘要
当部署在复杂的长期任务上时,自主大语言模型(LLM)代理越来越多地面临可靠性、上下文消耗和执行稳定性瓶颈。虽然整体提示工程和无状态工具调用范例难以扩展,但该领域正在迅速向\emph{代理技能}收敛:模块化程序抽象,将执行知识外化为可重用、可执行和可移植的工件。本文为代理技能生态系统建立了统一的系统基础和参考架构。我们将技能形式化为将高级认知规划与确定性执行环境联系起来的外化程序知识,并系统地描述了九个阶段生命周期的架构:自主发现、创作和表示格式、内存存储、动态检索和路由、组合和编排、执行和修复、终身适应、经验评估和安全治理。我们进一步研究市场动态、公共注册表和新兴的对抗性威胁向量,以及运行时验证和防御机制。最后,我们对软件工程、操作系统导航、嵌入式机器人和科学发现的系统实现进行分类,同时强调持续学习和基准现实主义中的关键开放挑战。这项工作将代理技能建立为构建可扩展、强大且可验证的自主语言代理的基础范例。