论文
三通道分数冲突中的受控获取和弃权
Controlled Acquisition and Abstention in Three-Channel Score Conflicts
摘要
当音频、视频和文本不一致时,仅凭准确性并不能表明是否获取其他来源或放弃。我们在受控的三分基准中研究这些选择:一项政策观察两个签名分数,可能会以一定的成本要求第三个分数,并且可以放弃。主要奖励是特定于机制的:弃权仅对于一种指定的模糊性机制是正确的,并且在混合腐败下受到惩罚。匹配控制表明,阈值策略与请求较少的始终请求决策相匹配;它相对于始终回答融合的优势取决于分配给该模糊性的奖励。在部分保留的合成分裂中,阈值策略在 83 个种子中达到 0.789 +/- 0.006 目标决策准确性和 0.481 +/- 0.014 效用。三分多数参考达到 0.626 +/- 0.008 和 0.252 +/- 0.016,但使用更多信息。在匹配预算测试中,仅训练值选择器在 10% 和 25% 预算下比无查询和匹配随机策略提高了效用,而配对不确定性在每个预算下都有更高的效用。在 50% 和 63.7% 预算下,选择者 尽管非歧义准确性稍高,但实用性较低。如果所有弃权票均得分不正确,则多数票的效用将超过阈值政策。在中心时间设置下,全轨迹控制与神经模型相匹配,而位置扰动将它们分开。在保留的演员情感片段上,八帧融合对于两个编码器对具有相反符号的精度差异,两个演员间隔都包含零;匹配请求路由增益很小且不确定。这些结果将全模态准确性与预请求选择值分开,并表明选择值取决于预算和观察到的对排名。