论文
谁的声音在摘要中幸存下来?大语言模型员工听力的语音保留审计
Whose Voice Survives the Summary? A Voice-Retention Audit of LLM Employee Listening
摘要
组织越来越多地通过大语言模型 (LLM) 摘要将员工反馈传递给领导者,这是一个未经审计的层,可以压制已经发出的声音。我们引入了语音保留/表征比率指标来衡量摘要中的表征偏差,并将其应用于由一家全球专业服务公司提供的 2,586 个自由文本回复组成的双语(英语/德语)语料库。首先,员工提出批评比表扬更可靠(不表扬的情况是前者的 82 倍)。其次,在 45 个领导者摘要中,管道按受欢迎程度而不是情绪进行过滤:批评仍然存在,但曾经表达过的担忧在 86% 的情况下会被丢弃,简短的内容和仅限德语的内容在同一轴上丢失(主题保留 0.14 与 0.74;德语方向)。控制频率后,情绪没有独立影响;这种危害是由普遍性驱动的,而纯情感审计却忽略了这一点。有针对性的提示仅恢复命名主题。我们提供指标、现场证据和分类的语音保留卡。