论文

通过加权速度引导进行对象感知后台控制编辑

Object-Aware Background-Controlled Editing via Weighted Velocity Guidance

模型推理解码与生成控制

摘要

无需训练 图像编辑通过修改提示条件去噪速度,在推理时引导扩散或流匹配生成模型。现有的基于速度的编辑器通常在潜在空间上全局应用提示引起的残差,并依赖模型来隐式定位语义变化。对于以对象为中心的编辑,这些残差在目标对象之外很少为零,因此小的非目标分量可能会在多步积分过程中累积,导致背景漂移和不稳定的对象边界。我们提出了对象感知速度控制(OAVC),这是一个 无需训练 框架,它将对象级控制引入到速度集成过程中。 OAVC 将语义残差的作用与它们注入动态的方式分离。它在源提示下构造背景锚定的参考接口,然后在目标提示下执行对象本地化的安全语义注入。受约束的注入算子抑制了引起漂移的速度分量,而时间自适应空间权重则稳定了对象边界附近的过渡。 OAVC 不需要训练或修改预训练的模型参数。使用图像和视频校正流主干进行的以对象为中心的图像和视频基准实验表明,在保留有效的局部可编辑性的同时,背景保留、结构保真度、边界稳定性和时间一致性得到了改善。