论文

校准了吗?不适合所有人:性取向和宗教标记如何扭曲 LLM 医学 QA 的准确性和信心

Calibrated? Not for Everyone: How Sexual Orientation and Religious Markers Distort LLM Accuracy and Confidence in Medical QA

模型评测鲁棒性、公平性与可信度评测

摘要

大语言模型 (LLM) 的安全临床部署不仅需要高精度,还需要强大的不确定性校准,以确保模型在适当时遵循临床医生的要求。我们的论文研究了患者的社会描述符(特别是性取向和宗教信仰)如何扭曲这些不确定信号和模型的准确性。通过评估 2,364 个医学问题及其反事实变体的 9 个通用和生物医学 LLM,我们证明身份标记会导致“校准危机”。 “同性恋”标记始终会引发绩效下降,而交叉身份会对校准产生特殊的、非累加性的伤害。此外,在开放式生成环境中经过临床医生验证的案例研究证实,这些失败并不是多项选择格式的产物。我们的结果表明,社会身份线索的存在不仅会改变预测,还会改变预测。它影响信心信号的可靠性,对基于信心的临床工作流程中的公平护理和安全部署构成重大风险。