论文
心理健康污名的在线沟通自动评测
Automatic Evaluation of Mental Health Stigma in Online Communication
摘要
心理健康污名危害深重,但其复杂性使评估困难。污名可涉及显式贬低,也包括更微妙的形式:责备、恐惧、家长式怜悯、社交疏远、结构性排斥与歧视。我们提出一个有理论依据的基准,用于在线沟通中心理健康污名的自动评测:由自然发生的在线新闻与社交媒体文本组成,标注了跨多种心理健康状况的细粒度污名分类。标注框架包含二元污名检测任务与覆盖(i)污名模式、(ii)领域、(iii)特定污名形式具体成分的多层分类。我们把该框架应用于提及六种心理健康状况的文本,并将大语言模型与检测情感、毒性、仇恨言论的污名相关分类器一并评估。结果显示:心理健康污名未被训练检测这些邻近构型的模型很好捕捉;除非给出显式操作规则,LLM常高估污名——呼应决策规则在人类标注中的重要性。我们在GitHub发布基准公开部分、标注、污名典型范例与代码。代码/项目页:https://github.com/jemimakang/mh_stigma。