论文
人类价值观很重要:调查 LLM Agent社区中的偏差如何塑造集体行为
Human Values Matter: Investigating How Misalignment Shapes Collective Behaviors in LLM Agent Communities
摘要
随着LLM越来越融入人类社会,从社会科学角度评价其人类价值取向越来越受到人们的关注。然而,目前还不清楚为什么人类价值观对 LLM 很重要,特别是在基于 LLM 的多智能体系统中,在该系统中,群体级别的失败可能会因个人不一致的行为而累积。我们问,与人类价值观的不一致是否会改变 LLM Agent的集体行为以及它会引起什么变化?在这项工作中,我们引入了 CIVA,这是一种基于社会科学理论的受控多智能体环境,其中 LLM 智能体形成社区并自主交流、探索和竞争资源,从而能够系统地操纵价值流行和行为分析。通过全面的模拟实验,我们揭示了三个关键发现。 (1) 我们确定了几个在很大程度上塑造社区集体动态的结构性关键价值观,包括那些偏离 LLM 原始方向的价值观。由于这些值的错误指定,我们(2)在宏观层面检测系统故障模式,例如灾难性崩溃,(3)在微观层面观察欺骗和权力寻求等紧急行为。这些结果提供了定量证据,表明人类价值观对于 LLM 的集体成果至关重要,并激励未来的多主体价值协调。