论文

CPEMH:面向心理健康筛查基础模型系统提示驱动行为评估与保障的智能体框架

CPEMH: An Agentic Framework for Prompt-Driven Behavior Evaluation and Assurance in Foundation-Model Systems for Mental Health Screening

智能体系统Agent Harness

摘要

本文提出CPEMH,一个智能体框架,用于评估在基于转录文本数据集上进行心理健康筛查的基础模型系统中的提示驱动行为。CPEMH作为大规模语言系统中行为保障的一种工程方法论,引入编排式架构,自主执行提示策略的设计、评估与选择,实现对跨上下文行为变异性的系统化控制。其模块化智能体设计结合了编排者、推理与评估智能体,在整个提示生命周期中确保可追溯性、可复现性与稳健性。一项基于访谈转录文本的自动化抑郁筛查案例研究展示了该框架在对话式和临床敏感领域中稳定并审计基础模型行为的能力。经验教训强调了模块化编排在行为保障中的作用、稳定性优先于架构复杂性的取向,以及将F1、偏差与稳健性整合为核心验收标准。

CPEMH:面向心理健康筛查基础模型系统提示驱动行为评估与保障的智能体框架:论文配图
图2:分布内(IS)与分布外(OOS)联合视角下的偏差与鲁棒性对比。