AnoleVLA: Lightweight Vision-Language-Action Model with Deep State Space Models for Mobile Manipulation
AnoleVLA:基于深度状态空间模型的轻量级视觉-语言-动作模型用于移动操作
机构 * Keio University(keio大学)
专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI
AI总结 本文提出AnoleVLA,一种轻量级视觉-语言-动作模型,通过深度状态空间模型高效处理多模态序列,提升移动操作的效率与安全性。