Look, Focus, Act: Efficient and Robust Robot Learning via Human Gaze and Foveated Vision Transformers
看、聚焦、行动:通过人类注视和中央凹视觉变换器实现高效且稳健的机器人学习
机构 * University of California, Berkeley(加州大学伯克利分校) ; Tongji University(同济大学) ; University of California, Davis(加州大学戴维斯分校)
专题命中 机器人学习 :robot learning(title,abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV
AI总结 研究如何将人类注视融入机器人策略以提升效率与稳健性,开发GIAVA系统,通过中央凹补丁令牌化将注视信息集成到视觉变换器,减少计算量,降低计算开销,增强稳健性,在高精度任务中提高成功率,凸显人类启发的中央凹视觉处理的潜力。
Comments Project page: https://soltanilara.github.io/giava/