Act, Think or Abstain: Complexity-Aware Adaptive Inference for Vision-Language-Action Models
行动、思考或退缩:面向视觉-语言-动作模型的复杂度感知自适应推理
机构 * Department of Electronics, Information, and Bioengineering, Politecnico di Milano(电子、信息与生物工程系,米兰理工学院)
专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract,abstract_cn);分类 cs.RO、cs.CV
AI总结 本文提出一种复杂度感知的自适应推理框架,通过动态路由视觉-语言-动作模型的执行,提升任务复杂性检测效率。