arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4115 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4115 篇

2502.16863 2025-02-25 cs.MA cs.LG cs.RO 62%

Leveraging Large Language Models for Effective and Explainable Multi-Agent Credit Assignment

Kartik Nagpal, Dayi Dong, Jean-Baptiste Bouvier, Negar Mehr

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments 8 pages+Appendix, 6 Figures, AAMAS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16198 2025-02-25 cs.NI cs.AI cs.ET cs.LG 62%

An Autonomous Network Orchestration Framework Integrating Large Language Models with Continual Reinforcement Learning

Masoud Shokrnezhad, Tarik Taleb

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments IEEE Communications Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15922 2025-02-25 cs.LG cs.RO 62%

On the Design of Safe Continual RL Methods for Control of Nonlinear Systems

Austin Coursey, Marcos Quinones-Grueiro, Gautam Biswas

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15662 2025-02-24 cs.AI cs.LG 62%

Automating Curriculum Learning for Reinforcement Learning using a Skill-Based Bayesian Network

Vincent Hsiao, Mark Roberts, Laura M. Hiatt, George Konidaris, Dana Nau

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12330 2025-02-20 cs.RO cs.LG 62%

X-IL: Exploring the Design Space of Imitation Learning Policies

Xiaogang Jia, Atalay Donat, Xi Huang, Xuan Zhao, Denis Blessing, Hongyi Zhou, Han A. Wang, Hanyi Zhang, Qian Wang, Rudolf Lioutikov, Gerhard Neumann

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12320 2025-02-20 cs.RO cs.CV 62%

Towards Fusing Point Cloud and Visual Representations for Imitation Learning

Atalay Donat, Xiaogang Jia, Xi Huang, Aleksandar Taranovic, Denis Blessing, Ge Li, Hongyi Zhou, Hanyi Zhang, Rudolf Lioutikov, Gerhard Neumann

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16824 2025-02-20 cs.LG cs.AI 62%

Uncertainty Representations in State-Space Layers for Deep Reinforcement Learning under Partial Observability

Carlos E. Luis, Alessandro G. Bottero, Julia Vinogradska, Felix Berkenkamp, Jan Peters

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

Comments TMLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10097 2025-02-17 cs.AI cs.LG 62%

Causal Information Prioritization for Efficient Reinforcement Learning

Hongye Cao, Fan Feng, Tianpei Yang, Jing Huo, Yang Gao

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09923 2025-02-17 cs.CV cs.LG 62%

Self-Consistent Model-based Adaptation for Visual Reinforcement Learning

Xinning Zhou, Chengyang Ying, Yao Feng, Hang Su, Jun Zhu

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.CV、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07829 2025-02-13 cs.CV cs.LG 62%

Preference Alignment on Diffusion Model: A Comprehensive Survey for Image Generation and Editing

Sihao Wu, Xiaonan Si, Chi Xing, Jianhong Wang, Gaojie Jin, Guangliang Cheng, Lijun Zhang, Xiaowei Huang

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.CV、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07825 2025-02-13 cs.CV cs.AI 62%

Pre-Trained Video Generative Models as World Simulators

Haoran He, Yang Zhang, Liang Lin, Zhongwen Xu, Ling Pan

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.CV

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16687 2025-02-11 cs.LG cs.AI 62%

Subgoal Discovery Using a Free Energy Paradigm and State Aggregations

Amirhossein Mesbah, Reshad Hosseini, Seyed Pooya Shariatpanahi, Majid Nili Ahmadabadi

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16790 2025-02-11 cs.LG cs.RO 62%

Curriculum Reinforcement Learning for Complex Reward Functions

Kilian Freitag, Kristian Ceder, Rita Laezza, Knut Åkesson, Morteza Haghir Chehreghani

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04418 2025-02-10 cs.LG cs.AI 62%

Autotelic Reinforcement Learning: Exploring Intrinsic Motivations for Skill Acquisition in Open-Ended Environments

Prakhar Srivastava, Jasmeet Singh

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments 12 pages, 12 figures

Journal ref International Journal of Computer Trends and Technology, vol. 73, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15599 2025-02-10 cs.LG cs.AI 62%

Pareto-Optimal Learning from Preferences with Hidden Context

Ryan Bahlous-Boldi, Li Ding, Lee Spector, Scott Niekum

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05675 2025-02-07 cs.LG cs.RO cs.SY eess.SY 62%

M$^3$PC: Test-time Model Predictive Control for Pretrained Masked Trajectory Model

Kehan Wen, Yutong Hu, Yao Mu, Lei Ke

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.RO、cs.LG

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02265 2025-02-05 cs.LG cs.AI 62%

Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control

Donghe Chen, Yubin Peng, Tengjie Zheng, Han Wang, Chaoran Qu, Lin Cheng

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments 13 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02133 2025-02-05 eess.SY cs.AI cs.LG cs.SY 62%

Synthesis of Model Predictive Control and Reinforcement Learning: Survey and Classification

Rudolf Reiter, Jasper Hoffmann, Dirk Reinhardt, Florian Messerer, Katrin Baumgärtner, Shamburaj Sawant, Joschka Boedecker, Moritz Diehl, Sebastien Gros

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01652 2025-02-05 cs.LG cs.AI 62%

Hybrid Group Relative Policy Optimization: A Multi-Sample Approach to Enhancing Policy Optimization

Soham Sane

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments 11 Pages, 18 Equations, 1 Table

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01034 2025-02-04 cs.RO cs.LG 62%

End-to-End Imitation Learning for Optimal Asteroid Proximity Operations

Patrick Quinn, George Nehma, Madhur Tiwari

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments 7 pages, 8 figures. Submitted to the 2025 IEEE Aerospace Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03195 2025-01-30 cs.LG cs.AI cs.NE 62%

Deep reinforcement learning for machine scheduling: Methodology, the state-of-the-art, and future directions

Maziyar Khadivi, Todd Charter, Marjan Yaghoubi, Masoud Jalayer, Maryam Ahang, Ardeshir Shojaeinasab, Homayoun Najjaran

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Journal ref Computers & Industrial Engineering, 2025, 110856

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15529 2025-01-28 cs.LG cs.AI cs.CR 62%

UNIDOOR: A Universal Framework for Action-Level Backdoor Attacks in Deep Reinforcement Learning

Oubo Ma, Linkang Du, Yang Dai, Chunyi Zhou, Qingming Li, Yuwen Pu, Shouling Ji

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

Comments 21 pages, 12 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05027 2025-01-28 cs.LG cs.AI 62%

Optimizing Automatic Differentiation with Deep Reinforcement Learning

Jamie Lohoff, Emre Neftci

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Accepted as a spotlight paper at NeurIPS 2024

Journal ref Proceedings of the 38th Conference on Neural Information Processing Systems. 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00204 2025-01-22 cs.RO cs.LG cs.SY eess.SY 62%

AirPilot: Interpretable PPO-based DRL Auto-Tuned Nonlinear PID Drone Controller for Robust Autonomous Flights

Junyang Zhang, Cristian Emanuel Ocampo Rivera, Kyle Tyni, Steven Nguyen

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments 9 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02512 2025-01-16 cs.LG cs.AI 62%

Continual Diffuser (CoD): Mastering Continual Offline Reinforcement Learning with Experience Rehearsal

Jifeng Hu, Li Shen, Sili Huang, Zhejian Yang, Hechang Chen, Lichao Sun, Yi Chang, Dacheng Tao

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03562 2025-01-09 cs.LG cs.AI 62%

Rethinking Adversarial Attacks in Reinforcement Learning from Policy Distribution Perspective

Tianyang Duan, Zongyuan Zhang, Zheng Lin, Yue Gao, Ling Xiong, Yong Cui, Hongbin Liang, Xianhao Chen, Heming Cui, Dong Huang

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments 10 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00170 2025-01-03 cs.HC cs.AI cs.LG 62%

CREW: Facilitating Human-AI Teaming Research

Lingyu Zhang, Zhengran Ji, Boyuan Chen

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Our project website is at: http://generalroboticslab.com/CREW

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19765 2024-12-30 cs.RO cs.LG 62%

From Ceilings to Walls: Universal Dynamic Perching of Small Aerial Robots on Surfaces with Variable Orientations

Bryan Habas, Aaron Brown, Donghyeon Lee, Mitchell Goldman, Bo Cheng

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments 7 pages, 8 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19538 2024-12-30 cs.RO cs.AI cs.MA 62%

Scalable Hierarchical Reinforcement Learning for Hyper Scale Multi-Robot Task Planning

Xuan Zhou, Xiang Shi, Lele Zhang, Chen Chen, Hongbo Li, Lin Ma, Fang Deng, Jie Chen

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19311 2024-12-30 cs.AI cs.HC cs.LG cs.MA 62%

xSRL: Safety-Aware Explainable Reinforcement Learning -- Safety as a Product of Explainability

Risal Shahriar Shefin, Md Asifur Rahman, Thai Le, Sarra Alqahtani

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Accepted to 24th International Conference on Autonomous Agents and Multiagent Systems (AAMAS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏