论文
智能体代购中的角色一致性与偏好泄露
When Agents Shop for You: Role Coherence in AI-Mediated Markets
摘要
消费者越来越多地将购买决策委托给人工智能代理,以自然语言描述他们的偏好和身份。我们认为,这些表示构成了一种信息渠道,即角色一致性,通过该渠道,卖方可以在买方代理人不明确披露的情况下推断出支付意愿,从而导致偏好泄漏。在一项实验中,语言模型购买智能体依据自然语言消费者画像进行购物,我们表明,仅通过对话进行的卖方推断就恢复了几乎等比例地还原了支付意愿。将此设置与带有保密指令的数字预算条件进行比较,可以清楚地将角色一致性与指令遵循失败区分开来。由于这种泄漏是由授权本身引起的,因此无法仅在提示层面缓解。相反,我们提出了一种架构干预措施,可以在个性化和偏好隐私之间进行权衡。