论文
你是A洞吗?公平、多视角的道德推理框架
Are You the A-hole? A Fair, Multi-Perspective Ethical Reasoning Framework
摘要
聚合自然语言判断的标准方法(例如多数投票)在应用于高度冲突的领域时通常无法产生逻辑上一致的结果,将不同的意见视为噪音。我们提出了一种神经符号聚合框架,通过加权最大可满足性(MaxSAT)将冲突解决形式化。我们的管道利用语言模型将非结构化自然语言解释映射为可解释的逻辑谓词和置信度权重。然后,这些组件在 Z3 求解器中被编码为软约束,将聚合问题转换为优化任务,寻求冲突证词之间的最大一致性。使用 Reddit r/AmItheAsshole 论坛作为大规模道德分歧的案例研究,我们的系统生成逻辑上连贯的判决,在 62% 的情况下与基于受欢迎程度的标签存在分歧,并得到与独立人类评估者 86% 的一致率的证实。这项研究证明了将神经语义提取与形式求解器相结合以增强嘈杂的人类推理聚合中的逻辑健全性和可解释性的有效性。