论文
稳健即显着:消息灵通的对手将最佳信号移至显着极
Robust Is Salient: An Informed Adversary Moves the Optimal Signal onto the Salience Pole
摘要
当知情的对手共享受限信号通道的受众时,最能保护真相的信号就是最能描述真相的信号。在 108 个验证项上,对抗鲁棒性最优与之前工作中的显着极点完全一致。在 200,000 个项目池中,两者仅在 2,748 个项目上存在差异——恰好位于先前的贝叶斯显着性坐标未定义的位置。在定义时,鲁棒性是通过从贝叶斯判别完全转向显着性来实现的。我们通过向对手介绍强制选择任务(摘自《欺骗:香港谋杀案》)来展示这一点。对手了解目标,观察信号,并使用说服预算 $β$ 提出最强的错误答案。随着 $β$ 的增长,最佳信号从后验最大化选项转变为边际最大化选项;在$β= 0$,游戏再现了原始的预言机模型,听众温度为$τ= 1$。这种效果是真实的:18.2% 的资源池具有在有限预算下变化的最佳值,并且每个项目的关键预算都是准确的。这种巧合在结构上限制了经验评估。两个对手框架在 108 个项目中的 30 到 77 个项目上更改了 7 种语言模型的选择选项,而达到了确切的无效率。然而,没有任何测量可以确定这种运动是朝着对手感知的最佳方向还是朝着显着性方向,因为这两个选项是相同的。这是结构性限制,而不是无效结果。诊断检查很便宜:在评估对手意识之前,验证稳健目标是否与评估项目的启发式目标一致。