论文

TexTailor:通过自适应服装调节保留纹理的视频虚拟试穿

TexTailor: Texture-Preserving Video Virtual Try-On via Adaptive Garment Conditioning

应用与实践内容创作

摘要

视频虚拟试穿因其在数字时尚和智能电商领域的广阔潜力而受到越来越多的关注。然而,现有方法主要关注低分辨率设置,当扩展到高分辨率场景时仍然面临巨大挑战。这些限制可归因于两个主要因素:(1)丰富的服装参考信息利用不足,(2)跨模态交互过程中服装和视频表示之间缺乏明确的位置建模,这削弱了细粒度的局部对应。为了解决这些问题,我们提出了 TexTailor,这是一种基于预训练视频 Diffusion Transformer 构建的高保真视频虚拟试戴框架。具体来说,我们引入了一种时间步自适应调制机制,可以在整个去噪过程中动态调整服装视觉表示。我们进一步开发了帧对齐的位置编码策略来加强服装到视频的对应性,以及减少异构条件之间干扰的多源注入设计。对多个视频虚拟试穿基准(包括高分辨率 Eevee 数据集)进行的大量实验表明,TexTailor 在服装细节保留、时间一致性和整体视频质量方面实现了具有竞争力的性能。