论文
AnyBottle:保留真正需要概念的紧凑解释
AnyBottle: A Recipe to Only Keep the Concepts You Really Need
摘要
概念瓶颈模型 (CBM) 通过人类可解释的概念来路由预测,从而使预测变得可检查和可干预,但最初需要概念注释。无注释变体消除了这一要求,但通常使用大型概念词汇表,在训练和推理中都是静态的,产生比任何任务或预测需求都大的瓶颈,并且更难以检查。我们提出了 AnyBottle,这是构建紧凑的、特定于任务的 CBM 的单一方法。 AnyBottle 仅假设一个冻结的 骨干模型 和一个无监督的概念池,例如稀疏自动编码器。然后,在相同的 骨干模型 上训练的黑盒 教师模型 会指导选择:每一轮都添加最能解释瓶颈当前故障的概念,候选者仅限于 教师模型/学生模型 分歧的区域。在此选择顺序上使用嵌套 dropout 进行训练,最终瓶颈可以从任何概念前缀准确预测,因此推理在早期有信心的输入上花费更少的概念,而在困难的输入上花费更多。由于没有阶段是特定于模态的,因此新的域和任务只需要交换 骨干模型 和概念池。在六个视觉和两个文本数据集以及两个 教师模型 范例中,AnyBottle 产生的瓶颈比无注释基线更少的概念和更高的概念一致性,同时保持接近黑盒参考。总体而言,AnyBottle 表明,无注释并不意味着规模变大:一个小的、发现的词汇可以与一个大得多的固定词汇一样具有表现力。
