2603.19201
2026-08-12
cs.RO
版本更新
OmniVTA: Visuo-Tactile World Modeling for Contact-Rich Robotic Manipulation
OmniVTA: 用于接触密集机械操作的视觉-触觉世界建模
Yuhang Zheng, Songen Gu, Yupeng Zheng, Weize Li, Yujie Zang, Shuai Tian, Xiang Li, Ce Hao, Chen Gao, Si Liu, Haoran Li, Yilun Chen, Shuicheng Yan, Wenchao Ding
机构
*
TARS Robotics(TARS机器人实验室)
;
National University of Singapore(新加坡国立大学)
;
Fudan University(复旦大学)
;
CASIA(中国科学院自动化研究所)
;
Tsinghua University(清华大学)
;
Zhongguancun Academy(中关村学院)
;
Beihang University(北京航空航天大学)
AI总结
本文提出OmniVTA框架,结合预测接触建模与高频触觉反馈,通过大规模视觉-触觉-动作数据集提升接触密集操作的性能与泛化能力。