One-shot Adaptation of Humanoid Whole-body Motion with Walking Priors
单样本适应人类全身体态与行走先验
Hao Huang, Geeta Chandra Raju Bethala, Shuaihang Yuan, Congcong Wen, Mengyu Wang, Anthony Tzes, Yi Fang
机构
*
Embodied AI and Robotics (AIR) Lab, NYUAD(纽约大学阿布扎比分校具身人工智能与机器人实验室)
;
NYUAD Center for Artificial Intelligence and Robotics (CAIR)(纽约大学阿布扎比分校人工智能与机器人中心)
;
New York University Abu Dhabi(纽约大学阿布扎比分校)
;
Harvard Ophthalmology AI Lab, Harvard University(哈佛大学眼科人工智能实验室)
Off-Policy Safe Reinforcement Learning with Constrained Optimistic Exploration
基于约束乐观探索的非策略安全强化学习
Guopeng Li, Matthijs T. J. Spaan, Julian F. P. Kooij
机构
*
Faculty of Mechanical Engineering(机械工程学院)
;
Delft University of Technology(代尔夫特理工大学)
;
Faculty of Electrical Engineering, Mathematics and Computer Science(电气工程、数学和计算机科学学院)
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院)
;
Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大型模型与智能治理研究重点实验室)
;
Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(教育部下一代智能搜索与推荐工程研究中心)
;
Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)
;
Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)
Rewarding DINO: Predicting Dense Rewards with Vision Foundation Models
奖励DINO:基于视觉基础模型预测密集奖励
Pierre Krack, Tobias Jülg, Wolfram Burgard, Florian Walter
机构
*
Department of Computer Science & Artificial Intelligence, University of Technology Nuremberg(技术大学纽伦堡计算机科学与人工智能系)
;
TUM School of Computation, Information and Technology, Technical University of Munich(慕尼黑技术大学计算、信息与技术学院)
PerlAD: Towards Enhanced Closed-loop End-to-end Autonomous Driving with Pseudo-simulation-based Reinforcement Learning
PerlAD:基于伪模拟的强化学习在闭环端到端自动驾驶中的应用
Yinfeng Gao, Qichao Zhang, Deqing Liu, Zhongpu Xia, Guang Li, Kun Ma, Guang Chen, Hangjun Ye, Long Chen, Da-Wei Ding, Dongbin Zhao
机构
*
School of Automation and Electrical Engineering, University of Science and Technology Beijing(北京科技大学自动化与电气工程学院)
;
Xiaomi EV(小牛电动车)
;
State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室)
ICPRL: Acquiring Physical Intuition from Interactive Control
ICPRL: 从交互控制中获取物理直觉
Xinrun Xu, Pi Bu, Ye Wang, Börje F. Karlsson, Ziming Wang, Tengtao Song, Qi Zhu, Jun Song, Shuo Zhang, Zhiming Ding, Bo Zheng
机构
*
Institute of Software, Chinese Academy of Science(中国科学院软件研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Alibaba Group(阿里巴巴集团)
;
RUC(中国人民大学)
;
PUC-Rio(里约热内卢联邦大学)
Partially Equivariant Reinforcement Learning in Symmetry-Breaking Environments
部分等价强化学习在对称破坏环境中
Junwoo Chang, Minwoo Park, Joohwan Seo, Roberto Horowitz, Jongmin Lee, Jongeun Choi
机构
*
School of Mechanical Engineering, Yonsei University, Seoul, South Korea(延世大学机械工程学院,首尔,韩国)
;
Department of Artificial Intelligence, Yonsei University, Seoul, South Korea(延世大学人工智能系,首尔,韩国)
;
Department of Mechanical Engineering, University of California, Berkeley, United States(加州大学伯克利分校机械工程系,美国)
Diffusion Policy through Conditional Proximal Policy Optimization
通过条件近端策略优化实现扩散策略
Ben Liu, Shunpeng Yang, Hua Chen
机构
*
Southern University of Science and Technology, Shenzhen, China(南方科技大学)
;
Hong Kong University of Science and Technology, Hongkong, China(香港科技大学)
;
Zhejiang University-University of Illinois Urbana-Champaign Institute, Haining, China(浙江大学-伊利诺伊大学厄巴纳-香槟分校联合研究所)