论文
LLM 可以公平雇用吗?简历筛选中的种族偏见
Can LLMs Hire Fairly? Racial Bias in Resume Screening
摘要
我们使用 Kline、Rose 和 Walters (2022) 的配对简历方法审计了 14 个主流 大语言模型 (LLM) 的招聘歧视情况。唯一的 2023 年版本模型再现了劳动力市场歧视实地实验中记录的亲白人回调差距($+2.12$ pp,在 1\% 水平上显着)。 2024 年或之后发布的每个型号都显示出零差距或显着的亲黑人逆转(高达 −3.01个百分点)。同样的模式也适用于性别轴。基于 14 个模型中每个模型的 24,024 个配对帖子,我们的结果记录了各代模型中算法招聘偏见方向的逆转。