Continuous-Discrete Reinforcement Learning for Hybrid Control in Robotics
Michael Neunert, Abbas Abdolmaleki, Markus Wulfmeier, Thomas Lampe, Jost Tobias Springenberg, Roland Hafner, Francesco Romano, Jonas Buchli, Nicolas Heess, Martin Riedmiller
RARM: Confidence-Gated Progress Reward Modeling for RL in Manipulation
RARM:基于置信度门控的进展奖励建模用于操作中的强化学习
Pengzhi Yang, Xinyu Wang, Pengyu Jing, Kehan Wen, Yiduo Qu, Zhenhao Huang, Minghao Fu, Xin Liu, Yaheng Shen, Fan Shi
机构
*
NUS Human-Centered Robotic Lab(新加坡国立大学人机共融机器人实验室)
;
University of Cambridge(剑桥大学)
;
School of Artificial Intelligence, Nanjing University(南京大学人工智能学院)
机构
*
School of Engineering, Kyushu University(九州大学工学系)
;
Faculty of Information Science and Electrical Engineering, Kyushu University(九州大学信息科学与电子工学系)
;
School of Information Science and Electrical Engineering, Kyushu University(九州大学信息科学与电子工学系)
In-Context Reinforcement Learning via Communicative World Models
通过通信世界模型进行上下文强化学习
Fernando Martinez-Lopez, Tao Li, Yingdong Lu, Juntao Chen
机构
*
Department of Computer and Information Sciences, Fordham University(福特汉姆大学计算机与信息科学系)
;
Department of Systems Engineering, City University of Hong Kong(香港城市大学系统工程系)
;
IBM Research(IBM研究院)
Behavior Cloning of MPC for 3-DOF Robotic Manipulators
三自由度机械臂MPC的行为克隆
Theo Guegan, Dexter Wen Jie Teo
机构
*
University of Waterloo(多伦多大学)
;
Universite de Technologie de Compiègne(技术与科学大学)
;
Nanyang Technological University(南洋理工大学)
;
Polytechnique Montréal(蒙特利尔理工学院)
Omni-scale Learning-based Sequential Decision Framework for Order Fulfillment of Tote-handling Robotic Systems
基于全尺度学习的料箱搬运机器人系统订单履行序贯决策框架
Jiaxin Liu, Peng Yang, Yuping Li, Xinyue Xie
机构
*
Institution of Data and Information, Shenzhen International Graduate School, Tsinghua University, Nanshan District, Shenzhen 518055, China(数据与信息研究所,深圳国际研究生院,清华大学,南山区,深圳518055,中国)