论文
UWM-JEPA:在置信空间中想象的预测世界模型
UWM-JEPA: Predictive World Models That Imagine in Belief Space
摘要
部分观察环境的世界模型必须想象多个兼容的隐藏未来,并在反事实行动下在它们之间进行引导。联合嵌入预测架构(JEPA)在潜在空间中执行此操作,但向量值潜在没有内部结构来通过盲目轨迹采样来承载对隐藏延续的信念。我们介绍了酉世界模型 JEPA (UWM-JEPA),这是一种 JEPA 世界模型,具有隐藏在联合系统环境空间上的密度矩阵和学习的酉预测器。该构造在轨迹采样期间准确地保留了联合状态谱,因此预测器本身无法消除所表示的不确定性。在隐藏速度指示器任务中,需要在给定的动作序列下进行五步前向模拟,并且目标观察被屏蔽,UWM-JEPA 达到 0.77 的准确度,并且随着动作受到扰动而单调降级;在相同的反事实目标目标和行动头下训练的参数匹配的 LSTM-JEPA 在每种行动条件下都会崩溃到多数类精度 (0.53)。在盲轨迹采样下,UWM-JEPA 在短视野内丢失探测 R^2 的不到 10 个点,而矢量潜在基线丢失 41 和 68;然而,两者都依赖于保留的上下文探测,在预测器而不是编码器中定位分离。动作敏感性本身需要针对反事实而不是教师强制目标进行训练,这一发现超出了单一参数化的范围。对于在部分可观测性下想象的 JEPA 世界模型来说,潜在几何和预测动力学很重要,而不仅仅是冻结上下文编码能力。