TAIHRI: Task-Aware 3D Human Keypoints Localization for Close-Range Human-Robot Interaction
TAIHRI:面向近距离人机交互的任务感知3D人体关键点定位
机构 * Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) ; Tencent Robotics X(腾讯机器人实验室X) ; Futian Laboratory(福田实验室)
专题命中 视觉定位与Grounding :vision-language model(abstract);VLM(abstract);分类 cs.CV
AI总结 TAIHRI是首个针对近距离人机交互的视觉-语言模型,通过任务感知的3D关键点定位实现人机交互中的精准空间定位,提升机器人对任务相关身体部位的识别与响应能力。