概要:VLA 的空间感知能力提升也算是业内一个研究热点了,因为大部分VLA采用的单目相机虽然能够识别物体及其语义,但缺少明确的几何信息。对于机器人来说,看出“这是一个杯子”还不够,还需要判断杯子距离机械手有多远、应该从哪个方向接近,以及夹爪是否已经准确对准目标;这项工作的核心目标,就是利用双目立体视觉,提升机器人对空间位置、物体深度和相机视角变化的感知能力;
声明:上述声音采用AI合成,解析内容为原创;解析仅针对该文发布时,arXiv上已公开被解析论文的最新版本的内容进行;其中所有涉及原论文的图、数据都引用自原论文,如涉及侵权,请及时联系删除;人工解读,难免有错误遗漏,如有发现及时联系修改;如需要深入研究建议阅读原文;

