论文
用于视图一致的文本到 3D 生成的结构能量指导
Structural Energy Guidance for View-Consistent Text-to-3D Generation
摘要
基于扩散模型的文本到 3D 生成通常会遇到 Janus 问题,导致跨视点的几何图形不一致。这项工作将二维扩散先验中的视点偏差确定为主要原因,并提出了结构能量引导采样(SEGS)、无需训练 和即插即用框架来提高多视图一致性。 SEGS在U-Net特征的PCA子空间中构造结构能量,并将其梯度注入到去噪过程中。它可以轻松集成到 SDS/VSD 管道中,无需重新训练。实验表明,SEGS 平均将 Janus Rate 降低了约 10%,并提高了多个基线(包括 DreamFusion、Magic3D 和 LucidDreamer)的 View-CS 分数。该方法有效地减轻了视点伪影,同时保持了外观保真度,为高质量文本转 3D 内容生成提供了灵活的解决方案。