论文
反提示:针对文本引导的图像到视频生成的图像保护
Anti-Prompt: Image Protection against Text-Guided Image-to-Video Generation
摘要
图像到视频生成的最新进展允许在文本指导下将单个图像动画化为令人信服的视频,从而带来严重的版权和隐私风险。我们提出了 Anti-Prompt,这是一种图像保护方法,可将难以察觉的扰动注入图像中,从而在文本引导的 I2V 生成中引起可见的不一致和结构故障。我们的方法是由简单的经验观察激发的。当从现代 I2V 模型中删除文本指导时,生成质量显着下降,不仅在运动真实性方面,而且在主题保存、结构连贯性和时间一致性方面也如此。基于这一见解,Anti-Prompt 利用模型对文本指导的依赖,在去噪过程中减弱文本条件交互,同时加强仅视觉路径。为了进一步系统地评估保护有效性,我们引入了 Video-LLM 辅助评估协议,该协议提供对生成伪影和不一致性的可解释的、基于框架的分析。在两种代表性 I2V 架构上的实验表明,我们的方法在提高效率和跨模型可移植性的同时实现了强大的保护性能。