OmniVTLA: Vision-Tactile-Language-Action Models with Semantic-Aligned Tactile Sensing
OmniVTLA:具有语义对齐触觉感知的视觉-触觉-语言-动作模型
机构 * Shanghai Jiao Tong University(上海交通大学) ; Paxini Tech(帕辛尼科技)
专题命中 VLA模型 :action model(title);VLA(abstract,abstract_cn);vision-language-action(abstract);分类 cs.RO
AI总结 提出OmniVTLA架构,通过双路径触觉编码器框架和语义对齐触觉ViT,结合新数据集ObjTac,显著提升机器人操作中接触密集任务的成功率和轨迹平滑度。
Comments Accepted by IEEE Robotics and Automation Letters (RA-L). ObjTac dataset: https://readerek.github.io/Objtac.github.io