EvoScene-VLA: Evolving Scene Beliefs Inside the Action Decoder for Chunked Robot Control
EvoScene-VLA: 在动作解码器中进化场景信念用于分块机器人控制
机构 * Australian National University(澳大利亚国立大学) ; The University of Queensland(昆士兰大学) ; Beijing Normal University(北京师范大学)
专题命中 VLA模型 :VLA(title,title_cn);vision-language-action(abstract,abstract_cn);分类 cs.RO、cs.AI
AI总结 本文提出EvoScene-VLA,通过在动作解码器中维护更新的场景状态,改进分块机器人控制中的多步控制预测,提升了场景信念的持续性和准确性。