论文

面向医疗保健的智能体技能实证研究:实践、缺口与治理

An Empirical Study of Agent Skills for Healthcare: Practice, Gaps, and Governance

模型评测智能体系统Agent Skills模型能力评测

摘要

医疗自动化受本地流程与组织约束塑造,智能体能力很少能跨机构原样迁移。智能体技能——为AI智能体打包可复用流程的自包含目录——正成为跨多样医疗 setting 适配医疗智能体的流程层。我们对医疗智能体技能做首个实证分析:从ClawHub的58,159个公开技能中筛出557个医疗相关技能,沿功能、部署上下文、自治性与安全性等十个维度标注。我们发现:公开医疗技能强调面向患者的工作流自动化与监测,而非医疗智能体研究所 foreground 的诊断治疗类任务;医疗生命周期与专科临床输入的覆盖仍不均衡;通用技术风险不能可靠代表临床风险。这些发现把医疗技能定位为当前基准与风险框架尚未覆盖的流程层。

面向医疗保健的智能体技能实证研究:实践、缺口与治理:论文配图
图 4. 所有 557 项医疗保健技能的临床影响(行,从上到下递减)和自主水平(列,L1-L5 从最低到最高)的联合分布。每项技能都分配有一对(影响力、自主性)。