论文

相同的问题,不同的历史:大语言模型 中的语言、民族认同和信用

Same question, different history: language, national identity, and credit in large language models

模型评测鲁棒性、公平性与可信度评测

摘要

谁发明了收音机,是俄罗斯的亚历山大·波波夫还是意大利的古列尔莫·马可尼?电话是美国贝尔的成就还是意大利梅乌奇的成就?印刷术属于中国的毕升还是德国的古腾堡?答案不仅取决于历史记录,还取决于语言和观点。我们分析了 21 项有争议的发明和发现中的 11 项广泛使用的 大语言模型,并以 12 种语言和 75,896 条回复进行了评估。虽然模型通常承认信用存在争议,但查询语言会系统地影响出现的索赔人。当使用相关语言提出问题时,地位较低的申请人更有可能出现,而占主导地位的英语人士在不同语言中保持稳定。在控制了响应长度、模型差异、历史重要性和国家纪念程度后,这些模式仍然存在。因此,语言就像一个开关,激活同一历史的不同国家版本,从同一问题系统地产生不同的国家记忆。我们将此解释为 大语言模型 作为文化记忆的分布式系统发挥作用的证据,其中语言条件使历史变得可见,从而促成了平庸民族主义的计算形式。