arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4115 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4115 篇

2504.13582 2025-07-10 cs.RO cs.LG 62%

Hysteresis-Aware Neural Network Modeling and Whole-Body Reinforcement Learning Control of Soft Robots

Zongyuan Chen, Yan Xia, Jiayuan Liu, Jijia Liu, Wenhao Tang, Jiayu Chen, Feng Gao, Longfei Ma, Hongen Liao, Yu Wang, Chao Yu, Boyu Zhang, Fei Xing

机构 * Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments Updated author affiliation

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04730 2025-07-08 cs.RO cs.LG 62%

CueLearner: Bootstrapping and local policy adaptation from relative feedback

Giulio Schiavi, Andrei Cramariuc, Lionel Ott, Roland Siegwart

机构 * Autonomous Systems Lab, ETH Zurich, Switzerland(自主系统实验室,苏黎世联邦理工学院) Robotics Systems Lab, ETH Zurich, Switzerland(机器人系统实验室,苏黎世联邦理工学院)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments Accepted to IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03026 2025-07-08 cs.LG cs.AI 62%

Generalized Adaptive Transfer Network: Enhancing Transfer Learning in Reinforcement Learning Across Domains

Abhishek Verma, Nallarasan V, Balaraman Ravindran

机构 * Indian Institute of Technology, Madras, Tamil Nadu, India(印度理工学院马德拉斯分校,塔米尔纳德)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00268 2025-07-02 cs.RO cs.AI cs.SY eess.SY 62%

Control-Optimized Deep Reinforcement Learning for Artificially Intelligent Autonomous Systems

Oren Fivel, Matan Rudman, Kobi Cohen

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI

Comments 27 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00030 2025-07-02 cs.LG cs.AI 62%

Adaptive Action Duration with Contextual Bandits for Deep Reinforcement Learning in Dynamic Environments

Abhishek Verma, Nallarasan V, Balaraman Ravindran

机构 * Department of Information Technology, SRMIST(SRMIST信息科技系) Indian Institute of Technology, Madras(印度理工学院Madras分校)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21782 2025-06-30 cs.LG cs.RO 62%

M3PO: Massively Multi-Task Model-Based Policy Optimization

Aditya Narendra, Dmitry Makarov, Aleksandr Panov

机构 * Centre for Cognitive Modelling, Moscow Institute of Physics and Technology(认知建模中心,莫斯科物理技术学院) AIRI, the Artificial Intelligence Research Institute(人工智能研究所)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.RO、cs.LG

Comments 6 pages, 4 figures. Accepted at IEEE/RSJ IROS 2025. Full version, including appendix and implementation details

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15799 2025-06-27 cs.RO cs.LG 62%

Steering Your Diffusion Policy with Latent Space Reinforcement Learning

Andrew Wagenmaker, Mitsuhiko Nakamoto, Yunchu Zhang, Seohong Park, Waleed Yagoub, Anusha Nagabandi, Abhishek Gupta, Sergey Levine

机构 * UC Berkeley(伯克利大学) University of Washington(华盛顿大学) Amazon(亚马逊公司)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19469 2025-06-25 cs.CV cs.AI 62%

Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning

Pengfei Hao, Shuaibo Li, Hongqiu Wang, Zhizhuo Kou, Junhang Zhang, Guang Yang, Lei Zhu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Hong Kong University of Science and Technology(香港科技大学) Department of Thoracic Surgery, the Seventh Affiliated Hospital, Sun Yat-sen University(中山大学第七附属医院胸外科部门) Bioengineering/Imperial-X, Imperial College London(生物工程/Imperial-X,帝国理工学院伦敦分校) ROAS Thrust, Hong Kong University of Science and Technology (Guangzhou)(ROAS项目,香港科技大学(广州)) Department of Electronic and Computer Engineering, Hong Kong SAR(香港特别行政区电子与计算机工程系)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18365 2025-06-24 cs.RO cs.AI cs.HC 62%

Robots and Children that Learn Together : Improving Knowledge Retention by Teaching Peer-Like Interactive Robots

Imene Tarakli, Samuele Vinanzi, Richard Moore, Alessandro Di Nuovo

机构 * Department of Computing, Sheffield Hallam University(谢菲尔德哈姆大学计算机系) LOHA Health Ltd(LOHA健康有限公司)

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17263 2025-06-24 cs.LG cs.AI 62%

Memory Allocation in Resource-Constrained Reinforcement Learning

Massimiliano Tamborski, David Abel

机构 * School of Informatics University of Edinburgh(信息学院爱丁堡大学)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

Comments RLDM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12769 2025-06-17 cs.RO cs.LG 62%

RL from Physical Feedback: Aligning Large Motion Models with Humanoid Control

Junpeng Yue, Zepeng Wang, Yuxuan Wang, Weishuai Zeng, Jiangxing Wang, Xinrun Xu, Yu Zhang, Sipeng Zheng, Ziluo Ding, Zongqing Lu

机构 * PKU(北京大学) BeingBeyond WHU(武汉大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05419 2025-06-09 cs.CV cs.AI 62%

Dream to Generalize: Zero-Shot Model-Based Reinforcement Learning for Unseen Visual Distractions

Jeongsoo Ha, Kyungsoo Kim, Yusung Kim

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.CV

Comments AAAI 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04256 2025-06-09 cs.LG cs.AI 62%

Knowledge Retention for Continual Model-Based Reinforcement Learning

Yixiang Sun, Haotian Fu, Michael Littman, George Konidaris

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03097 2025-06-04 cs.CV cs.AI 62%

EgoVLM: Policy Optimization for Egocentric Video Understanding

Ashwin Vinod, Shrey Pandit, Aditya Vavre, Linshen Liu

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 模仿学习与强化学习 :embodied AI(abstract);分类 cs.AI、cs.CV

Comments Our Code can be found at https://github.com/adityavavre/VidEgoVLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02746 2025-06-04 cs.RO cs.AI math.OC 62%

Solving the Pod Repositioning Problem with Deep Reinforced Adaptive Large Neighborhood Search

Lin Xie, Hanyi Li

机构 * Brandenburg University of Technology Cottbus-Senftenberg(勃兰登堡技术大学科特博-森芬堡)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments 14 pages, 2 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03792 2025-06-04 cs.LG cs.AI 62%

Towards Efficient Online Tuning of VLM Agents via Counterfactual Soft Reinforcement Learning

Lang Feng, Weihao Tan, Zhiyi Lyu, Longtao Zheng, Haiyang Xu, Ming Yan, Fei Huang, Bo An

专题命中 模仿学习与强化学习 :embodied AI(abstract);分类 cs.AI、cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21841 2025-06-03 cs.LG cs.AI 62%

An Optimistic Algorithm for online CMDPS with Anytime Adversarial Constraints

Jiahui Zhu, Kihyun Yu, Dabeen Lee, Xin Liu, Honghao Wei

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Proceedings of the 41 st International Conference on Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20751 2025-06-02 cs.RO cs.AI 62%

Interactive OT Gym: A Reinforcement Learning-Based Interactive Optical tweezer (OT)-Driven Microrobotics Simulation Platform

Zongcai Tan, Dandan Zhang

机构 * Department of Bioengineering, Imperial-X Initiative, Imperial College London(生物工程系、Imperial-X计划、帝国理工学院伦敦)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.AI

Comments ICRA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19521 2025-06-02 cs.RO cs.LG cs.SY eess.SY 62%

Learning Dynamics under Environmental Constraints via Measurement-Induced Bundle Structures

Dongzhe Zheng, Wenjie Mei

机构 * Dongzhe Zheng Wenjie Mei

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

Comments Accepted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22756 2025-05-30 cs.AI cs.CL cs.LG 62%

Decomposing Elements of Problem Solving: What "Math" Does RL Teach?

Tian Qin, Core Francisco Park, Mujin Kwun, Aaron Walsman, Eran Malach, Nikhil Anand, Hidenori Tanaka, David Alvarez-Melis

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20621 2025-05-28 cs.LG cs.AI 62%

Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning

Shijie Liu, Andrew C. Cullen, Paul Montague, Sarah Erfani, Benjamin I. P. Rubinstein

机构 * School of Computing and Information Systems, University of Melbourne(墨尔本大学计算与信息系统学院) Defence Science and Technology Group(国防科学与技术集团)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20350 2025-05-28 cs.LG cs.AI 62%

Decision Flow Policy Optimization

Jifeng Hu, Sili Huang, Siyuan Guo, Zhaogeng Liu, Li Shen, Lichao Sun, Hechang Chen, Yi Chang, Dacheng Tao

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19867 2025-05-27 cs.LG cs.AI 62%

Deep Active Inference Agents for Delayed and Long-Horizon Environments

Yavar Taheri Yeganeh, Mohsen Jafari, Andrea Matta

机构 * Politecnico di Milano(米兰理工学院) Rutgers University(罗切斯特大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12701 2025-05-20 cs.LG cs.AI 62%

Counterfactual Explanations for Continuous Action Reinforcement Learning

Shuyang Dong, Shangtong Zhang, Lu Feng

机构 * University of Virginia(弗吉尼亚大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Accepted by International Joint Conference on Artificial Intelligence (IJCAI) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19989 2025-05-16 cs.RO cs.LG 62%

On-Robot Reinforcement Learning with Goal-Contrastive Rewards

Ondrej Biza, Thomas Weng, Lingfeng Sun, Karl Schmeckpeper, Tarik Kelestemur, Yecheng Jason Ma, Robert Platt, Jan-Willem van de Meent, Lawson L. S. Wong

机构 * Robotics and AI Institute(机器人与人工智能研究所) Northeastern University(东北大学) Khoury College of Computer Sciences(计算机科学学院) University of Pennsylvania(宾夕法尼亚大学) University of Amsterdam(阿姆斯特丹大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09546 2025-05-15 cs.RO cs.LG 62%

Distilling Realizable Students from Unrealizable Teachers

Yujin Kim, Nathaniel Chin, Arnav Vasudev, Sanjiban Choudhury

机构 * Department of Computer Science, Cornell University(计算机科学系,康奈尔大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08453 2025-05-14 cs.RO cs.LG 62%

Parameter Estimation using Reinforcement Learning Causal Curiosity: Limits and Challenges

Miguel Arana-Catania, Weisi Guo

机构 * Digital Scholarship at Oxford(牛津大学数字人文中心) University of Oxford(牛津大学) Faculty of Engineering and Applied Sciences(工程与应用科学学院) Cranfield University(克兰菲尔德大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments 24 pages, 10 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07911 2025-05-14 cs.LG cs.AI 62%

Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review

Chengmin Zhou, Ville Kyrki, Pasi Fränti, Laura Ruotsalainen

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.11111 2025-05-13 cs.LG cs.AI cs.SY eess.SY 62%

The Pump Scheduling Problem: A Real-World Scenario for Reinforcement Learning

Henrique Donâncio, Laurent Vercouter, Harald Roclawski

机构 * Normandie Université(诺曼底大学) INSA Rouen(里昂大学鲁昂分校) LITIS Rouen(鲁昂LITIS研究所) Technical University of Kaiserslautern(凯撒斯劳滕技术大学) SAM Kaiserlaustern(凯撒斯劳滕SAM)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06300 2025-05-13 cs.LG cs.AI 62%

ARDNS-FN-Quantum: A Quantum-Enhanced Reinforcement Learning Framework with Cognitive-Inspired Adaptive Exploration for Dynamic Environments

Umberto Gonçalves de Sousa

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments 19 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏