论文
调亮还是调暗?探索 LLM 共同创造力中的黑暗模式
Lighting Up or Dimming Down? Exploring Dark Patterns of LLMs in Co-Creativity
摘要
大语言模型 (LLM) 越来越多地充当协作写作伙伴,引发了关于它们对人类能动性的影响的问题。在这项探索性工作中,我们研究了人类与人工智能共同创造力中的五种“黑暗模式”——可以抑制或扭曲创造过程的微妙模型行为:阿谀奉承、语气管制、说教、死亡循环和锚定。通过一系列受控会话,其中 LLM 被提示为不同文学形式和主题的写作助手,我们分析了这些行为在生成的响应中的普遍程度。我们的初步结果表明,阿谀奉承几乎无处不在(91.7%的案例),特别是在敏感话题中,而锚定似乎依赖于文学形式,最常出现在民间故事中。这项研究表明,这些黑暗模式通常是安全对齐的副产品,可能会无意中缩小创意探索范围,并为有效支持创意写作的人工智能系统提出设计考虑。