论文

正确的话语,错误的时机:基于临床医生的年轻人与 ChatGPT 之间的 19,930 次对话中的痛苦分析

Right Words, Wrong Moment: A Clinician-Grounded Analysis of Distress in 19,930 Conversations between Young People and ChatGPT

模型评测安全与风险评测

摘要

年轻人在遇到困难时越来越多地求助于通用会话Agent (GPCA),例如 ChatGPT。我们调查年轻人(18-25 岁)使用 ChatGPT 的体验。我们首先收集了 158 名年轻人的 19,930 条 ChatGPT 对话和调查数据。然后,我们选择了五个反映用户困扰的示例对话。最后,我们要求十名临床医生回顾这五次对话。我们发现,与同龄人相比,感到苦恼的参与者对 ChatGPT 的情感投入程度更高,并且使用它带来的行为改变也更大。当他们在极度痛苦的时刻求助于 ChatGPT 时,ChatGPT 很快给出了过于戏剧化的反应和过多的以行动为导向的建议。临床医生认可 ChatGPT 的可用性及其大部分措辞,但发现了七个流程失败,例如过早地跳到解决方案。我们将临床医生的反馈转化为设计指南,分为三个阶段:1)询问安全性,2)降低强度以恢复情绪调节,3)探索问题但不同意它们。