论文

OpenBelief-Nav:用于开放词汇语言引导导航的证据保存对象记忆

OpenBelief-Nav: Evidence-Preserving Object Memory for Open-Vocabulary Language-Guided Navigation

上下文与知识上下文工程

摘要

开放词汇 3D 场景图为语言引导导航提供紧凑的语义记忆,但映射对象通常通过单个融合特征或提交的语义标签公开。这种承诺可以从任务时间界面中消除少数但与任务相关的假设。我们提出了 OpenBelief-Nav,一种保留证据的对象记忆,它保留观察级短语、可靠性线索和帧掩模来源,同时保持单独的聚合几何和视觉表示。语义相关的短语被合并为独立于词汇的对象信念,特定任务的读出从中执行固定词汇投影或自由形式检索。在 5 个 ScanNet200 和 8 个 Replica 场景中,全置信投影的 mIoU 分数分别为 0.2742 和 0.2912,而匹配的早期提交读数的 mIoU 分数为 0.2393 和 0.2701。在 78 项 HM3D-YCB 导航试验中,共识和早期提交检索均取得了 60/78 的成功,而信念加权检索的成功率为 58/78,DualMap 的成功率为 55/78。在组织为 10 个匹配评估案例的 20 个 Unitree G1 运行中,相对于仅 top-1 执行,最多允许两次经过验证的候选尝试的修正策略将目标确认成功率从 6/10 提高到 8/10。代码将在接受后发布在 https://openbelief-nav.github.io/ 上。