Dynamic Execution Commitment of Vision-Language-Action Models
视觉-语言-动作模型的动态执行承诺
机构 * University of Adelaide(阿德莱德大学) ; Sichuan University(四川大学) ; Shanghai Jiao Tong University(上海交通大学) ; Monash University(墨尔本大学) ; Zhejiang University(浙江大学) ; Imperial College London(伦敦帝国理工学院)
专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract,abstract_cn);分类 cs.CV
AI总结 本文提出A3机制,通过将动态执行承诺重新定义为自推测前缀验证问题,解决了视觉-语言-动作模型在动态或分布外情况下执行鲁棒性和推理吞吐量之间的平衡问题。
Comments code is available at https://inceptionwang.github.io/A3/