In-Context Reinforcement Learning via Communicative World Models
通过通信世界模型进行上下文强化学习
Fernando Martinez-Lopez, Tao Li, Yingdong Lu, Juntao Chen
机构
*
Department of Computer and Information Sciences, Fordham University(福特汉姆大学计算机与信息科学系)
;
Department of Systems Engineering, City University of Hong Kong(香港城市大学系统工程系)
;
IBM Research(IBM研究院)
机构
*
School of Information Engineering, Henan University of Science and Technology(河南科技大学信息工程学院)
;
Shenzhen Research Institute of Big Data(深圳大数据研究院)
;
School of Logistics Engineering, Shanghai Maritime University(上海 Maritime University物流工程学院)
;
Shenzhen Technology University(深圳科技大学)
;
School of Computer Science, Wuhan University(武汉大学计算机学院)
;
School of Software Engineering, Tongji University(同济大学软件工程学院)
RoboGPT-R1: Enhancing Robot Task Planning with Reinforcement Learning
RoboGPT-R1: 通过强化学习增强机器人任务规划
Jinrui Liu, Bingyan Nie, Boyu Li, Yaran Chen, Yuze Wang, Shunsen He, Haoran Li
机构
*
Institute of Automation, CASIA(中国科学院自动化研究所)
;
School of Artificial Intelligence, UCAS(中国科学技术大学人工智能学院)
;
Huawei Cloud Technology Co., Ltd(华为云技术有限公司)
Comments10 pages, 12 figures. This arXiv version includes an appendix with qualitative simulation rollouts and additional ablations. Published at ICRA 2025
Journal ref2025 IEEE International Conference on Robotics and Automation (ICRA), pp. 1184-1192, 2025
RLRC: Reinforcement Learning-based Recovery for Compressed Vision-Language-Action Models
RLRC:基于强化学习的压缩视觉-语言-动作模型恢复
Yuxuan Chen, Yixin Han, Yize Huang, Xiao Li
机构
*
State Key Laboratory of Mechanical System and Vibration(机械系统与振动国家重点实验室)
;
Shanghai Key Laboratory of Intelligent Robotics(上海智能机器人重点实验室)
;
School of Mechanical Engineering, Shanghai Jiao Tong University(上海交通大学机械工程学院)
Roberto Capobianco, Harm van Seijen, Nolan D. Bard, Neil Burch, Fatima Davelouis, Josh Davidson, Alisa Devlic, Yunshu Du, Ishan Durugkar, Siddhant Gangapurwala, Daniel Hernandez, G. Zacharias Holland, Sahil Jain, Kenta Kawamoto, Raksha Kumaraswamy, Patrick MacAlpine, Dustin R. Morrill, Declan Oller, Francesco Riccio, Akanksha Saran, Craig Sherstan, Kaushik Subramanian, Thomas J. Walsh, Samuel Barrett, Kizza N. Frisbee, Mady Govil, Johannes Günther, Varun R. Kompella, James A. MacGlashan, Maxwell Svetlik, Michael D. Thomure, Jaden B. Travnik, Kevin Waugh, Elahe Aghapour, Florian Fuchs, Andreanne Lemay, Shruti Mishra, Takuma Seno, Peter Stone, Michael Spranger, Peter R. Wurman
机构
*
Sony AI, Zurich, Switzerland(索尼AI,苏黎世,瑞士)
;
Sony AI, North America (various locations)(索尼AI,北美(多地))
;
Sony AI, Tokyo, Japan(索尼AI,东京,日本)
机构
*
BioRobotics Institute, Scuola Superiore Sant’Anna, Pisa, Italy, and with the Department of Excellence in Robotics and AI, Scuola Superiore Sant’Anna, Pisa, Italy(生物机器人研究所,圣安娜高等学院,意大利比萨,以及与机器人与人工智能卓越部门,圣安娜高等学院,意大利比萨)
;
Institute for Systems and Robotics, Instituto Superior Técnico, Universidade de Lisboa(系统与机器人研究所,技术高等学院,里斯本大学)
The HydroGym Reinforcement Learning Platform for Fluid Dynamics
HydroGym:流体动力学的强化学习平台
Christian Lagemann, Sajeda Mokbel, Miro Gondrum, Mario Rüttgers, Yuning Wang, Pol Suárez, Ludger Paehler, Deniz A. Bezgin, Aaron B. Buhendwa, Jared L. Callaham, Samuel Ahnert, Nicholas Zolman, Xiao Shao, Jean-Christophe Loiseau, Nikolaus Adams, Matthias Meinke, Wolfgang Schröder, Kai Lagemann, Esther Lagemann, Ricardo Vinuesa, Steven L. Brunton
机构
*
University of Washington(华盛顿大学)
;
AI Institute in Dynamic Systems, University of Washington(华盛顿大学人工智能研究所)
;
RWTH Aachen University(亚琛工业大学)
;
Inha University(仁荷大学)
;
University of Michigan(密歇根大学)
;
KTH Royal Institute of Technology(瑞典皇家理工学院)
;
Technical University of Munich(慕尼黑工业大学)
;
Arts et Métiers Institute of Technology(国立高等工程技术学校)
;
CNAM(法国国立工艺学院)
;
DynFluid, HESAM Université(HESAM大学流体动力学实验室)
;
Munich Institute of Integrated Materials, Energy and Process Engineering, Technical University of Munich(慕尼黑工业大学综合材料、能源与工艺工程研究所)
;
JARA Center for Simulation and Data Science, RWTH Aachen University(亚琛工业大学JARA模拟与数据中心)
;
MediaTek Research(联发科技研究中心)
;
German Center for Neurodegenerative Diseases(德国神经退行性疾病中心)
Chain-of-Goals Hierarchical Policy for Long-Horizon Offline Goal-Conditioned RL
Chain-of-Goals 分层策略用于长视界离线目标条件强化学习
Jinwoo Choi, Sang-Hyun Lee, Seung-Woo Seo
机构
*
Department of Electrical and Computer Engineering, Seoul National University, Seoul, South Korea(首尔国立大学电气与计算机工程系)
;
Department of Automotive Engineering, Ajou University, Gyeonggi-do, South Korea(全州大学汽车工程系)
机构
*
School of Artificial Intelligence, Shanghai Jiao Tong University, Shanghai, China(上海交通大学人工智能学院)
;
Zhongguancun Academy, Beijing, China(中关村学院)
;
School of Integrated Circuits, Shanghai Jiao Tong University, Shanghai, China(上海交通大学集成电路学院)
;
School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(上海交通大学计算机科学学院)
;
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University, Beijing, China(北京大学计算机科学学院多媒体信息处理国家重点实验室)