论文
Map2World:将条件文本分段映射到 3D 世界生成
Map2World: Segment Map Conditioned Text to 3D World Generation
摘要
3D 世界生成对于沉浸式内容创建或自动驾驶模拟等应用至关重要。 3D 世界生成的最新进展已显示出可喜的成果;然而,这些方法受到网格布局的限制,并且在整个世界范围内都存在对象比例不一致的问题。在这项工作中,我们引入了一种新颖的框架 Map2World,它首先能够根据用户定义的任意形状和比例的分段地图生成 3D 世界,从而确保在广阔的环境中的全球范围的一致性和灵活性。为了进一步提高质量,我们提出了一个细节增强器网络,可以生成世界的精细细节。细节增强器通过合并全局结构信息,可以添加细粒度的细节,而不会影响整体场景的连贯性。我们设计整个管道以利用资产生成器的强大先验,即使在场景生成的训练数据有限的情况下,也能在不同领域实现强大的泛化。大量实验表明,我们的方法在用户可控性、尺度一致性和内容连贯性方面显着优于现有方法,使用户能够在更复杂的条件下生成 3D 世界。