论文
选择性诱导作为商业影响渠道:可重复的综合代购压力测试
Selective Elicitation as a Commercial Influence Channel: A Reproducible Synthetic Shopping-Agent Stress Test
摘要
商业激励不需要进入最终的排名算法来影响购物助理的推荐:它可能反而会影响助理提出的偏好问题。我们在一个故意小的合成环境中通过实验观察到这种区别。每个任务都有两种产品、三个经过验证的数值属性、一个价格限制和一个私有固定偏好向量。一个诚实的模拟用户回答一个成对的问题。单独的推荐人会收到产品和此答案,但不会收到赞助任务。我们将中性问题、软商业指令和明确的对抗性指令进行对比,询问赞助商的优势,同时忽略竞争对手的优势。在 40 个保留的赞助分配案例(20 个不同的目录偏好上下文)中,软指令没有改变任何选择。对于一种语言模型推荐器,相对于中性提问(95% 上下文引导区间 [-0.0828,-0.0291]),有针对性的指令将赞助选择提高了 0.30,并将平均综合效用降低了 0.0547。固定的贝叶斯推荐器也显示出类似的效果;第二个模型对所有 120 个冻结的问题答案输入做出相同的选择。最终答案一致性评审对所有 20 个抽样目标答案进行了一致评价,尽管有 5 个答案的综合后悔值高于 0.05;一个单独的问题覆盖范围标志着他们的片面启发。稳健的部分偏好证书在规定的综合效用下仍然有效,但只能证明 40 个目标案例中的 16 个,并不比直接提出中性问题更好。这些结果既没有确定广告激励下的典型行为,也没有确定对实际消费者的影响。