Recovery RL: Safe Reinforcement Learning with Learned Recovery Zones
Brijen Thananjeyan, Ashwin Balakrishna, Suraj Nair, Michael Luo, Krishnan Srinivasan, Minho Hwang, Joseph E. Gonzalez, Julian Ibarz, Chelsea Finn, Ken Goldberg
ROS-LLM: A ROS framework for embodied AI with task feedback and structured reasoning
ROS-LLM:一个用于具身AI的ROS框架,具有任务反馈和结构化推理
Christopher E. Mower, Yuhui Wan, Hongzhan Yu, Antoine Grosnit, Jonas Gonzalez-Billandon, Matthieu Zimmer, Jinlong Wang, Xinyu Zhang, Yao Zhao, Anbang Zhai, Puze Liu, Daniel Palenicek, Davide Tateo, Cesar Cadena, Marco Hutter, Jan Peters, Guangjian Tian, Yuzheng Zhuang, Kun Shao, Xingyue Quan, Jianye Hao, Jun Wang, Haitham Bou-Ammar
机构
*
Huawei Noah’s Ark Lab(华为诺亚实验室)
;
University of Leeds(利兹大学)
;
Technical University of Darmstadt(达姆施塔特技术大学)
;
East China Normal University(华东师范大学)
;
Huawei Technologies(华为技术有限公司)
;
ETH Zurich(苏黎世联邦理工学院)
;
University College London(伦敦大学学院)
VEGA: Electric Vehicle Navigation Agent via Physics-Informed Neural Operator and Proximal Policy Optimization
VEGA:基于物理信息神经算子和近端策略优化的电动汽车导航代理
Hansol Lim, Minhyeok Im, Jonathan Boyack, Jee Won Lee, Jongseong Brad Choi
机构
*
Department of Mechanical Engineering, State University of New York(机械工程系,纽约州立大学)
;
Department of Computer Science, State University of New York(计算机科学系,纽约州立大学)