论文
超越二元编辑:基于对抗子空间对齐的鲁棒多模态知识编辑
Beyond Binary Edits Robust Multimodal Knowledge Editing with Adversarial Subspace Alignment
摘要
多模态大语言模型(MLLM)需要高效的机制来更新知识而不损害既有能力。虽然内在多模态知识编辑实现了很强的可靠性与局部性,但其泛化性常常有限,无法将编辑传播到语义等价的视觉与语言变体上。这一问题源于缺乏显式语义监督、编辑范围僵化,以及在高维多模态空间中偏向锚定个别样本。我们通过显式瞄准泛化性来解决鲁棒的内在多模态知识编辑问题。我们以知识单元(knowledge unit)形式化鲁棒性——将语义等价的多模态输入归为一组,并把泛化定义为单元内预测的一致性。为暴露脆弱的语义区域,我们提出潜在对抗鲁棒化(LAR),在联合潜在空间中生成对抗性但语义连贯的变体。我们进一步提出秩约束子空间学习(RCSL),通过基于奇异值的目标在编辑层强制对抗表征的低秩对齐。大量分析从实证上证明了ASAM的有效性。
