论文

TRACE:通过有形重建和几何对齐的上下文视频遮蔽进行高保真 3D 场景编辑

TRACE: High-Fidelity 3D Scene Editing via Tangible Reconstruction and Geometry-Aligned Contextual Video Masking

应用与实践内容创作

摘要

现有的 3D 高斯泼溅 (3DGS) 编辑方法主要侧重于外观修改,并且常常难以支持灵活的几何编辑,同时保持结构完整性和场景一致的外观。为了解决这一限制,我们提出了 TRACE,这是一种网格引导的 3DGS 编辑框架,可自动将显式 3D 几何体与高斯场景对齐,并将几何锚定与外观协调分离。首先,多视图 3D 锚点合成在我们的 MV-TRACE 数据集上进行训练,用于场景相干的对象添加和修改,生成几何对齐的编辑锚点,而有形几何对齐 (TGA) 则执行从粗到细的网格场景配准。然后,上下文视频遮蔽 (CVM) 将投影的 3D 锚点集成到自回归视频扩散管道中,使其外观与周围场景协调一致,同时保持多视图一致性。我们在六个编辑类别的八个保留场景上评估 TRACE。 TRACE 在单个 NVIDIA RTX Pro 6000 GPU 上大约需要 10 分钟即可完成每次编辑。大量的实验表明,现有方法在编辑多功能性、结构完整性、语义对齐、多视图一致性和视觉质量方面取得了持续改进。