Manual2Skill++: Connector-Aware General Robotic Assembly from Instruction Manuals via Vision-Language Models
Manual2Skill++: 通过视觉语言模型实现连接器感知的指令手册驱动机器人装配
机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) ; University of Toronto(多伦多大学) ; Zhejiang University(浙江大学) ; Peking University(北京大学)
AI总结 本文提出Manual2Skill++框架,通过视觉语言模型从指令手册中提取结构化连接信息,构建层次化图表示,实现连接器为核心的装配任务理解与执行。
Journal ref ICRA2026