论文

从回声室到认知单一文化:大语言模型 将暂时偶然的党派联盟呈现为知识

From Echo Chambers to Epistemic Monoculture: Large Language Models Present Temporally Contingent Partisan Alignments as Knowledge

模型评测模型行为与机制分析

摘要

大语言模型 (LLM) 正在迅速成为公民和政治信息之间的接口。他们通常被视为“更好的谷歌”。虽然这个类比可能适用于某些情况,但对于民主政治来说却存在不直观的问题。搜索引擎检索人类创作的文档,而语言模型生成新颖的文本,这些文本必然嵌入不可见的框架决策。由于传递知识涉及框架,因此生成答案的系统不能充当“所有人类知识”的中立渠道。相反,这些系统正在成为一种新型的政治中介。机械证据表明,党派身份在 Llama 3.1 8B 模型内被编码为可定位的几何方向,并且对齐训练掩盖而不是删除这种结构。基于这些证据,我们提出了利用 2024 年模型训练截止点的指导实验。这一截止点幸运地落在美国政治以第二届特朗普政府和卫生政治的 MAHA 转型为标志的戏剧性调整之前,为我们提供了一个自然的实验。我们发现该模型将暂时偶然的党派联盟呈现为知识,没有区分事实和观点的机制。这一现实使信息环境超越了回声室,走向了一种认知单一文化,其中语言模型,旨在总结“所有人类知识”,实际上只是放大了其训练数据中固有的文化和党派分歧。