论文
NullEdit:通过 VLM 条件重定向实现隐形图像保护
NullEdit: Stealthy Image Protection via VLM Condition Redirection
摘要
现代图像编辑器将视觉语言模型 (VLM) 与扩散 Transformer 主干相结合,以根据没有 微调 的指令修改单个参考图像。此功能还可以对公开发布的图像进行未经授权的操作。现有的推理时间防御要么通过明显的损坏使编辑无效,从而暴露保护,要么允许它们继续进行身份或参考内容漂移,从而无法阻止编辑行为本身。相反,我们的目标是隐秘且无害的无操作,其中请求的编辑被抑制,输出保持自然且保留源代码,没有明显的伪影或身份替换,并且不存在恶意指令请求的有害语义。我们提出了 NullEdit,它的目标是在调节下游 DiT 主干之前,由参考图像和指令联合形成的 VLM 表示。使用正常编辑和无编辑锚点,NullEdit 重定向此表示,而交叉提示梯度平均将保护转移到保留的指令。在 CelebA-HQ 和 VGGFace2 上的 Step1X-Edit 和 Qwen-Image-Edit 中,NullEdit 相对于 SOTA 基线平均将 EditReward IF 分数降低 0.813,同时保留主题身份和源内容。