Reinforcing 3D Understanding in Point-VLMs via Geometric Reward Credit Assignment
通过几何奖励信用分配强化点-视觉-语言模型的3D理解
机构 * Northwestern Polytechnical University(西北工业大学) ; Southern University of Science and Technology(南方科技大学) ; The University of Sheffield(谢菲尔德大学) ; Hengqin Laboratory(横琴实验室) ; Tsinghua University(清华大学)
专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.CV
AI总结 本文提出几何奖励信用分配框架,通过分离整体监督信号并定向反馈,提升点-视觉-语言模型的3D结构对齐能力,同时引入重投影一致性项约束物理可行性,从而提升3D KPA和重投影一致性评分。
Comments 10 pages, 3 figures, 5 tables