论文

在视频扩散中使时间可编辑 Transformer

Making Time Editable in Video Diffusion Transformers

模型架构Transformer

摘要

用于视频生成的现代扩散 Transformer 提供对时间进程和时间动态编辑的有限控制。我们提出了一种时间控制方法,通过显式时间编辑扩展预训练的 DiT,允许控制运动速度和时间结构,而无需重新设计主干。其核心实现通过轻量级时间模块增强了预训练模型,保留了原始生成先验,同时扩展了其可控动态范围。