IVRA: Improving Visual-Token Relations for Robot Action Policy with Training-Free Hint-Based Guidance
IVRA: 通过无需训练的提示引导改善机器人动作策略的视觉-令牌关系
机构 * Stony Brook University(石溪大学) ; ETRI(电子技术研究院)
专题命中 空间理解 :spatial understanding(abstract);分类 cs.RO
AI总结 提出IVRA方法,利用模型内置视觉编码器的亲和力提示,无需额外编码器或重训练,在推理时调整视觉-令牌交互以增强空间理解,在多种VLA架构和任务上提升操作成功率。