Actor-Accelerated Policy Dual Averaging for Reinforcement Learning in Continuous Action Spaces
策略双平均加速器在连续动作空间强化学习中的应用
Ji Gao, Caleb Ju, Guanghui Lan, Zhaohui Tong
机构
*
School of Chemical and Biomolecular Engineering, Georgia Institute of Technology, GA, USA(化学与生物分子工程学院,佐治亚理工学院,美国加利福尼亚州)
;
H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology, GA, USA(H.米尔顿·斯图尔特工业与系统工程学院,佐治亚理工学院,美国加利福尼亚州)
Model-Free Co-Optimization of Manufacturable Sensor Layouts and Deformation Proprioception
无模型的可制造传感器布局与变形本体感觉共优化
Yingjun Tian, Guoxin Fang, Aoran Lyu, Xilong Wang, Zikang Shi, Yuhu Guo, Weiming Wang, Charlie C. L. Wang
机构
*
Department of Mechanical and Aerospace Engineering, The University of Manchester, United Kingdom(曼彻斯特大学机械与航空航天工程系)
;
Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong, Shatin, Hong Kong(香港中文大学机械与自动化工程系)
Safe Probabilistic Planning for Human-Robot Interaction using Conformal Risk Control
利用符合风险控制的人机交互安全概率规划
Jake Gonzales, Kazuki Mizuta, Karen Leung, Lillian J. Ratliff
机构
*
University of Washington, Department of Electrical and Computer Engineering(华盛顿大学电气与计算机工程系)
;
University of Washington, Department of Aeronautics and Astronautics(华盛顿大学航空与航天系)
Moving On, Even When You're Broken: Fail-Active Trajectory Generation via Diffusion Policies Conditioned on Embodiment and Task
继续前行,即使你已破损:通过扩散策略条件于躯体与任务的失败主动轨迹生成
Gilberto G. Briscoe-Martinez, Yaashia Gautam, Rahul Shetty, Anuj Pasricha, Marco M. Nicotra, Alessandro Roncone
机构
*
Dept. of Computer Science, University of Colorado Boulder, CO, USA(计算机科学系,科罗拉多大学博尔德分校)
;
Dept. of Electrical, Computer, and Energy Engineering, University of Colorado Boulder, CO, USA(电气、计算机与能源工程系,科罗拉多大学博尔德分校)