See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models
像机器人一样看:用于视觉-语言-动作模型的以机器人为中心的点图
机构 * KAIST AI(韩国科学技术院人工智能研究所) ; Holiday Robotics(假日机器人公司)
AI总结 研究视觉-语言-动作模型中因观察与动作定义的帧不匹配问题,提出以机器人为中心的点图方法,该方法能保留2D VLA所需网格,以最小架构变化集成到现有模型,实验证明其在模拟和实际机器人实验中表现优于基线。
Comments Project page: https://davian-robotics.github.io/pointmap/