论文

虚拟言语治疗师:面向个性化与监督下治疗的临床医生在环AI言语治疗智能体

Virtual Speech Therapist: A Clinician-in-the-Loop AI Speech Therapy Agent for Personalized and Supervised Therapy

智能体系统Agent 动作执行与治理

摘要

本文开发了虚拟言语治疗师(VST),这是一个基于智能体的智能平台,通过自动化、自适应的AI驱动工作流简化口吃评估并提供定制化的治疗规划。VST集成了最先进的基于深度学习的口吃分类与多智能体大语言模型(LLM)推理,以支持循证的临床决策。VST从患者语音样本的采集与特征提取开始,随后进行稳健的口吃类型分类。在这些输出的基础上,VST启动一个智能体推理过程,其中专门的LLM智能体自主地生成、批评并迭代改进个性化治疗计划。一个专门的批评智能体评估所有生成的治疗计划,以确保临床安全性、方法论严谨性,以及与同行评审证据和既有专业指南的一致性。最终输出是一份全面的、针对具体患者的治疗草案,供临床医生审阅。系统在纳入临床医生反馈后生成最终治疗方案,可用于患者实施,从而维持临床医生在环的范式。由专家言语治疗师开展的实验评估证实,VST能够持续生成高质量、有证据支撑的治疗建议。这些发现表明该系统有潜力增强临床工作流、减轻临床医生负担,并改善言语障碍人群的治疗效果。所提系统的交互式用户界面已在线提供:https://vocametrix.com/ai/stuttering-therapy-planning-agent ,支持实时口吃评估与个性化治疗规划。

虚拟言语治疗师:面向个性化与监督下治疗的临床医生在环AI言语治疗智能体:论文配图
图 1:虚拟言语治疗师代理的端到端管道。该过程从用户提供输入语音样本开始。该音频首先由口吃分类模块进行分析,该模块识别特定的不流畅类型,例如重复、阻塞或延长。同时,语音样本也被传递到 ASR 和音素分析器模块。基于此诊断输出、语音和文本转录,该虚拟言语治疗师为个性化治疗会话生成推荐治疗。在交付给用户之前,人工智能生成的治疗计划会被发送给 CITL 进行审查。临床言语治疗师向 VST 输出提供反馈,并提出修改后的治疗计划。临床言语治疗师拥有批准、拒绝或要求修改治疗计划的最终权力,以确保临床监督和安全。