Touch-R1: Reinforcing Touch Reasoning in MLLMs
Touch-R1:在多模态大语言模型中强化触觉推理
机构 * Xiamen University(厦门大学) ; Great Bay University(大湾大学) ; Fudan University(复旦大学) ; Nanjing University(南京大学) ; Daimon Robotics(达摩机器人)
AI总结 针对触觉推理中物理属性序数性和跨传感器分布偏移的挑战,提出基于触觉接地GRPO目标训练的Touch-R1模型,在TouchReason-Bench上平均性能超过Octopi-13B和GPT-4o。
Comments Our code and data will be made public on the https://laiyingxin2.github.io/Projects