GRaD-Nav++: Vision-Language Model Enabled Visual Drone Navigation with Gaussian Radiance Fields and Differentiable Dynamics
GRaD-Nav++: 基于视觉-语言模型的视觉无人机导航:高斯辐射场与可微动力学
机构 * Department of Mechanical Engineering, Stanford University(斯坦福大学机械工程系) ; Department of Aeronautics and Astronautics, Stanford University(斯坦福大学航空航天工程系)
专题命中 VLA模型 :VLA(abstract,abstract_cn);vision-language-action(abstract);分类 cs.RO
AI总结 GRaD-Nav++提出一种轻量级视觉-语言-动作框架,通过可微强化学习在3D高斯点云模拟器中训练,实现基于自然语言指令的实时无人机导航,展示在多任务和多环境下的高效导航能力。
Comments Published in: IEEE Robotics and Automation Letters ( Volume: 11, Issue: 2, February 2026)
Journal ref Chen, Qianzhong, et al. "Grad-nav++: Vision-language model enabled visual drone navigation with gaussian radiance fields and differentiable dynamics." IEEE Robotics and Automation Letters 11.2 (2025): 1418-1425