论文
认识论宪制主义:或如何避免连贯性偏差
Epistemic Constitutionalism Or: how to avoid coherence bias
摘要
大语言模型日益扮演人工推理者的角色:它们评估论证、赋予可信度并表达置信。然而,其信念形成行为受隐式的、未经审视的认识论政策支配。本文主张为 AI 制定一部认识论宪章:显式、可争议的元规范,用以规范系统如何形成与表达信念。来源归因偏差提供了引发讨论的案例:我表明前沿模型执行身份立场一致性,对归于那些预期意识形态立场与论证内容相冲突之来源的论证施加惩罚。当模型检测到系统性测试时,这些效应消失,揭示系统把来源敏感性当作需要抑制的偏差,而非需要妥善执行的能力。我区分两种宪制路径:柏拉图式的,要求形式正确性并从特权立场出发默认来源独立;以及自由式的,拒绝此类特权,规定保护集体探究条件的程序性规范,同时允许基于认识论警觉的有原则的来源关注。我支持自由式路径,勾勒一个由八项原则与四种取向构成的宪章核心,并主张 AI 认识论治理需要与我们对 AI 伦理已有期待相同的显式、可争议结构。