arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4116 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4116 篇

2209.04100 2025-04-29 cs.AI 57%

Task-Agnostic Learning to Accomplish New Tasks

Xianqi Zhang, Xingtao Wang, Xu Liu, Wenrui Wang, Xiaopeng Fan, Debin Zhao

机构 * Faculty of Computing, Harbin Institute of Technology(计算机学院,哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) Harbin Institute of Technology Suzhou Research Institute(哈尔滨工业大学苏州研究院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI

Comments 14 pages, 10 figures, Accepted by IEEE-TCDS

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15666 2025-04-23 cs.RO 57%

Symbolic Runtime Verification and Adaptive Decision-Making for Robot-Assisted Dressing

Yasmin Rafiq, Gricel Vázquez, Radu Calinescu, Sanja Dogramadzi, Robert M Hierons

机构 * Department of Computer Science(计算机科学系) University of Manchester(曼彻斯特大学) University of York(约克大学) School of Electrical and Electronic Engineering(电子与电气工程学院) The University of Sheffield(谢菲尔德大学) School of Computer Science(计算机科学学院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06725 2025-04-23 cs.RO 57%

AgilePilot: DRL-Based Drone Agent for Real-Time Motion Planning in Dynamic Environments by Leveraging Object Detection

Roohan Ahmed Khan, Valerii Serpiva, Demetros Aschalew, Aleksey Fedoseev, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory(智能空间机器人实验室) Center for Digital Engineering(数字工程中心) Skolkovo Institute of Science and Technology(斯克尔科夫科学与技术研究所)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

Comments Manuscript has been accepted at 2025 INTERNATIONAL CONFERENCE ON UNMANNED AIRCRAFT SYSTEMS (ICUAS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08195 2025-04-14 cs.MA cs.AI 57%

Graph Based Deep Reinforcement Learning Aided by Transformers for Multi-Agent Cooperation

Michael Elrod, Niloufar Mehrabi, Rahul Amin, Manveen Kaur, Long Cheng, Jim Martin, Abolfazl Razi

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

Comments 6 pages, 7 figures, Accepted to the 2025 IEEE International Conference on Communications Workshops (ICC Workshops)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05084 2025-04-08 cs.RO 57%

Speech-to-Trajectory: Learning Human-Like Verbal Guidance for Robot Motion

Eran Beeri Bamani, Eden Nissinman, Rotem Atari, Nevo Heimann Saadon, Avishai Sintov

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03938 2025-04-08 cs.RO 57%

Energy Efficient Planning for Repetitive Heterogeneous Tasks in Precision Agriculture

Shuangyu Xie, Ken Goldberg, Dezhen Song

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments ICRA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03185 2025-04-07 cs.CL cs.AI 57%

Learning Natural Language Constraints for Safe Reinforcement Learning of Language Agents

Jaymari Chua, Chen Wang, Lina Yao

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01915 2025-04-07 cs.NE cs.RO 57%

Overcoming Deceptiveness in Fitness Optimization with Unsupervised Quality-Diversity

Lisa Coiffard, Paul Templier, Antoine Cully

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10419 2025-04-04 eess.SY cs.RO cs.SY 57%

A nonlinear real time capable motion cueing algorithm based on deep reinforcement learning

Hendrik Scheidel, Camilo Gonzalez, Houshyar Asadi, Tobias Bellmann, Andreas Seefried, Shady Mohamed, Saeid Nahavandi

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08896 2025-04-04 cs.LG 57%

MAD-TD: Model-Augmented Data stabilizes High Update Ratio RL

Claas A Voelcker, Marcel Hussing, Eric Eaton, Amir-massoud Farahmand, Igor Gilitschenski

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23486 2025-04-01 cs.AI 57%

A Systematic Decade Review of Trip Route Planning with Travel Time Estimation based on User Preferences and Behavior

Nikil Jayasuriya, Deshan Sumanathilaka

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

Comments 6 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18366 2025-03-25 cs.RO 57%

Reinforcement Learning for Adaptive Planner Parameter Tuning: A Perspective on Hierarchical Architecture

Lu Wangtao, Wei Yufei, Xu Jiadong, Jia Wenhao, Li Liang, Xiong Rong, Wang Yue

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17615 2025-03-25 cs.RO physics.ins-det 57%

Feature Selection Based on Reinforcement Learning and Hazard State Classification for Magnetic Adhesion Wall-Climbing Robots

Zhen Ma, He Xu, Jielong Dou, Yi Qin, Xueyu Zhang

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments 21 pages, 11 figures, manuscript for Journal of Autonomous Robots

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15693 2025-03-21 cs.LG 57%

Good Actions Succeed, Bad Actions Generalize: A Case Study on Why RL Generalizes Better

Meng Song

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15265 2025-03-20 cs.CV 57%

DeepMesh: Auto-Regressive Artist-mesh Creation with Reinforcement Learning

Ruowen Zhao, Junliang Ye, Zhengyi Wang, Guangce Liu, Yiwen Chen, Yikai Wang, Jun Zhu

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.CV

Comments Project page: https://zhaorw02.github.io/DeepMesh/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03436 2025-03-20 cs.LG 57%

A Role of Environmental Complexity on Representation Learning in Deep Reinforcement Learning Agents

Andrew Liu, Alla Borisyuk

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07933 2025-03-19 cs.LG cs.SY eess.SY math.OC 57%

Offline Hierarchical Reinforcement Learning via Inverse Optimization

Carolin Schmidt, Daniele Gammelli, James Harrison, Marco Pavone, Filipe Rodrigues

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13415 2025-03-18 cs.MA cs.AI 57%

A Comprehensive Survey on Multi-Agent Cooperative Decision-Making: Scenarios, Approaches, Challenges and Perspectives

Weiqiang Jin, Hongyang Du, Biao Zhao, Xingwu Tian, Bohang Shi, Guang Yang

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

Comments 54 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08338 2025-03-12 cs.RO 57%

Trinity: A Modular Humanoid Robot AI System

Jingkai Sun, Qiang Zhang, Gang Han, Wen Zhao, Zhe Yong, Yan He, Jiaxu Wang, Jiahang Cao, Yijie Guo, Renjing Xu

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13683 2025-03-12 cs.RO 57%

PrefMMT: Modeling Human Preferences in Preference-based Reinforcement Learning with Multimodal Transformers

Dezhong Zhao, Ruiqi Wang, Dayoon Suh, Taehyeon Kim, Ziqin Yuan, Byung-Cheol Min, Guohua Chen

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06580 2025-03-11 cs.AI 57%

Agent models: Internalizing Chain-of-Action Generation into Reasoning models

Yuxiang Zhang, Yuqi Yang, Jiangming Shu, Xinyan Wen, Jitao Sang

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09781 2025-03-06 cs.CV 57%

VideoWorld: Exploring Knowledge Learning from Unlabeled Videos

Zhongwei Ren, Yunchao Wei, Xun Guo, Yao Zhao, Bingyi Kang, Jiashi Feng, Xiaojie Jin

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.CV

Comments Code and models are released at: https://maverickren.github.io/VideoWorld.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02279 2025-03-05 cs.LG 57%

DreamerV3 for Traffic Signal Control: Hyperparameter Tuning and Performance

Qiang Li, Yinhan Lin, Qin Luo, Lina Yu

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.LG

Comments 14 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18774 2025-03-05 cond-mat.supr-con cs.AI 57%

Self-training superconducting neuromorphic circuits using reinforcement learning rules

M. L. Schneider, E. M. Jué, M. R. Pufall, K. Segall, C. W. Anderson

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

Comments 15 pages, 6 figures

Journal ref npj Unconventional Computing. 2, 5 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01251 2025-03-04 cs.RO 57%

Catching Spinning Table Tennis Balls in Simulation with End-to-End Curriculum Reinforcement Learning

Xiaoyi Hu, Yue Mao, Gang Wang, Qingdu Li, Jianwei Zhang, Yunfeng Ji

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07465 2025-03-04 cs.LG 57%

Offline Reinforcement Learning with Domain-Unlabeled Data

Soichiro Nishimori, Xin-Qiang Cai, Johannes Ackermann, Masashi Sugiyama

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18655 2025-02-27 cs.LG 57%

Provably Efficient RL for Linear MDPs under Instantaneous Safety Constraints in Non-Convex Feature Spaces

Amirhossein Roknilamouki, Arnob Ghosh, Ming Shi, Fatemeh Nourzad, Eylem Ekici, Ness B. Shroff

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01361 2025-02-25 cs.LG 57%

To the Max: Reinventing Reward in Reinforcement Learning

Grigorii Veviurko, Wendelin Böhmer, Mathijs de Weerdt

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Journal ref Proceedings of the 41st International Conference on Machine Learning, PMLR 235:49455-49470, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06037 2025-02-25 q-fin.TR cs.LG q-fin.GN 57%

Quantitative Trading using Deep Q Learning

Soumyadip Sarkar

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14973 2025-02-21 cs.LG math.OC 57%

Efficiently Training Deep-Learning Parametric Policies using Lagrangian Duality

Andrew Rosemberg, Alexandre Street, Davi M. Valladão, Pascal Van Hentenryck

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 8 Main Pages, 8 Appendices, 7 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏