论文
以基督教对人类繁荣的理解评估人工智能
Evaluating Artificial Intelligence Through a Christian Understanding of Human Flourishing
摘要
人工智能(AI)对齐从根本上说是一个塑造(formation)问题,而不仅仅是安全问题。随着大语言模型(LLM)越来越多地充当中介参与道德审议与属灵探究,它们所做的不只是提供信息;它们还发挥着数字教理讲授工具的功能,主动塑造并规整人类的理解、决策与道德反思。为了使这种塑造性影响变得可见、可测量,我们提出了Flourishing AI Benchmark: Christian Single-Turn(FAI-C-ST),一个旨在依据基督教对人类繁荣(human flourishing)的理解、从七个维度评估前沿模型(Frontier Model)回答的框架。通过将20个前沿模型与多元主义和基督教专属标准进行对比,我们表明当前的AI系统并非世界观中立。相反,它们默认采取一种程序性世俗主义(Procedural Secularism),缺乏维持神学连贯性所需的根基,导致在繁荣的所有维度上出现约17分的系统性性能下降。最关键的是,信仰与灵性(Faith and Spirituality)维度出现了31分的下降。这些发现表明,价值观对齐方面的性能差距并非技术局限,而是源于训练目标优先考虑广泛可接受性与安全性,而非深入且内在连贯的道德或神学推理。