论文
世界模型代表的是三个问题
What a World Model Represents Is Three Questions
摘要
世界模型通过多种途径学习任务相关信息:观察重建、循环状态、时间过滤和显式任务监督。不同的路线可以提供不同的变量。同一变量也可以同时通过多个路径获得。如果是这样,查看哪条路线如果删除的话会增加最大的训练损失并不能告诉您模型实际使用哪条路线。问题是可达性,训练信号是否可以识别与任务相关的方向;承认,该方向是否可以从潜在的恢复;和分配,即符合条件的路线承载它。我们在具有一组已知的所需坐标的环境中测试它们。除非某些训练信号可以识别方向,否则方向无法进入潜在状态。重建、递归或过滤可能已经恢复了其中一些坐标;那么奖励或价值头就没有剩余方向可以承认。对于剩下的内容,目标提供多少个独立预测就是安装多少个坐标:一到四个独立预测允许一到四个方向,包括通过值头。可达性并不是承认:当累积的时间二阶矩系数是损失的百分之几时,在下一个词元预测下,时间二阶矩系数可以保持不存在,并且预测该系数的头会恢复它。作业是一个不同的测试。当单独训练时,两条路线都携带相同的变量,当我们反向时,它们不会交换载体,而删除载体的成本更高。在 Transformer 记录序列上训练的循环模型显示了相同的模式。在竞争路线开始清除探测阈值的点附近,独立训练运行不一致。因此,世界模型代表的是三个问题:哪些信息是可达的、哪些信息是监管认可的、以及哪些竞争路径承载这些信息。