Embodied Intelligence Observer

连续环境视觉语言导航的拓扑图宏动作闭环强化学习再审视

Original title: Revisiting Topological Graphs for Macro Action based Closed-loop Reinforcement Learning of Vision Language Navigation in Continuous Environment

ResearchAI 85

Source: arXiv cs.ROPublish time unverified

arXiv:2609.03906v1 Announce Type: new Abstract: Vision-Language Navigation in Continuous Environments (VLN-CE) requires an agent to follow natural language instructions through unseen environments. Existing imitation learning (IL) pipelines struggle in this closed-loop setting: behavior cloning suffers from distribution shift, and DAgger's expert actions become ambiguous upon trajectory deviation.

连续环境视觉语言导航的拓扑图宏动作闭环强化学习再审视 | Embodied Intelligence Observer