SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model
SafeDojo:基于交互世界模型的安全强化学习用于视觉-语言-动作模型
机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室) ; Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) ; Nanyang Technological University(南洋理工大学) ; Hong Kong University of Science and Technology(香港科技大学) ; University of Electronic Science and Technology of China(电子科技大学)
专题命中 模仿学习与强化学习 :world model(title,abstract);分类 cs.RO
AI总结 提出SafeDojo,首个基于模型的安全强化学习框架,通过交互式视频世界模型进行想象学习安全动作,结合解耦的任务奖励和安全代价信号,在SafeLIBERO和真实机器人上取得最佳安全成功率。
Comments 20 pages, 5 figures, 8 tables