VLA-Trace: Diagnosing Vision-Language-Action Models through Representation and Behavior Tracing
VLA-Trace: 通过表示与行为追踪诊断视觉-语言-动作模型
机构 * University of Science and Technology of China(中国科学技术大学) ; University of Manchester(曼彻斯特大学) ; Beihang University(北航) ; Fudan University(复旦大学) ; University of New South Wales(新南威尔士大学)
AI总结 提出VLA-Trace诊断框架,通过表示演化、因果控制归因和行为表现分析,揭示VLA模型在多模态知识向具身控制转化中的机制,发现不同模型在微调适应、多模态路由和语义遵循上的差异与局限。