论文
ViPS:用于自动装配网格的视频通知姿势空间
ViPS: Video-informed Pose Spaces for Auto-Rigged Meshes
摘要
运动装置提供了用于铰接 3D 网格的结构化接口,但缺乏任何关联的姿势空间,即给定网格的关节配置的合理流形的显式表示。如果没有这样的姿势空间,原始装备参数的随机采样或手动操作很容易导致语义和/或几何违规,例如解剖学过度延伸和非物理自相交。我们提出了视频通知姿势空间(ViPS),这是一种前馈框架,通过从预训练的视频扩散模型中提取运动先验来发现自动装配网格的有效关节的潜在分布。与依赖于稀缺的、艺术家创作的 4D 数据集或专注于重建单个运动实例的现有方法不同,ViPS 将生成视频模型先验转换为给定装备参数化的通用分布。应用于蒙皮网格的可微分几何验证器可以增强形状特定的完整性,而无需手动正则化器。我们的前馈模型揭示了一个平滑、紧凑且可控的姿势空间。反过来,这支持不同形状变化的采样、逆运动学的流形投影以及动画和关键帧的时间连贯轨迹。此外,经过提炼的 3D 姿势样本可用作指导视频扩散的语义代理,从而有效地闭合生成 2D 先验和结构化 3D 运动学控制之间的循环。我们的评估表明,仅使用视频先验进行训练的 ViPS 在合理性和多样性方面与在合成艺术家创建的 4D 数据上训练的最先进模型的性能相匹配。此外,作为一种通用模型,ViPS 对分布外物种和未见的骨骼拓扑表现出强大的零样本泛化能力。