视觉线索引导视频规划,CueNav自报狭窄通道成功率70%
给视频模型加上鸟瞰图和部分机身画面作为视觉线索,可让机器人导航成功率大幅提升:作者自报加入线索后迷宫导航成功率接近无线索方案的2倍,狭窄通道成功率达70%,并展示零样本语义条件导航与同一规划器跨机器人平台部署。此前的做法是让视频模型无线索地规划导航,再用逆动力学模型把预测视频转成动作,成功率明显更低。
这套名为CueNav的方法由TUM/MIRMI与MIT CSAIL团队提出,以上数字均为作者自报,摘要未说明测试是仿真还是实机,结果未经独立验证,项目页显示代码尚未放出;预印本9月15日提交arXiv、16日修订(arXiv:2609.16737)。
信息源:arxiv.org