arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4115 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4115 篇

2405.03711 2024-05-08 cs.LG cs.AI cs.NE cs.SY eess.SY 62%

Guidance Design for Escape Flight Vehicle Using Evolution Strategy Enhanced Deep Reinforcement Learning

Xiao Hu, Tianshu Wang, Min Gong, Shaoshi Yang

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments 13 pages, 13 figures, accepted to appear on IEEE Access, Mar. 2024

Journal ref IEEE Access, vol. 12, pp. 48210-48222, Mar. 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02425 2024-05-07 cs.RO cs.AI 62%

Learning Robot Soccer from Egocentric Vision with Deep Reinforcement Learning

Dhruva Tirumala, Markus Wulfmeier, Ben Moran, Sandy Huang, Jan Humplik, Guy Lever, Tuomas Haarnoja, Leonard Hasenclever, Arunkumar Byravan, Nathan Batchelor, Neil Sreendra, Kushal Patel, Marlon Gwira, Francesco Nori, Martin Riedmiller, Nicolas Heess

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15096 2024-05-01 cs.RO cs.LG 62%

Impedance Matching: Enabling an RL-Based Running Jump in a Quadruped Robot

Neil Guan, Shangqun Yu, Shifan Zhu, Donghyun Kim

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

Comments Accepted by Ubiquitous Robots 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13639 2024-05-01 cs.LG cs.AI 62%

Contrastive Preference Learning: Learning from Human Feedback without RL

Joey Hejna, Rafael Rafailov, Harshit Sikchi, Chelsea Finn, Scott Niekum, W. Bradley Knox, Dorsa Sadigh

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments ICLR 2024. Code released at https://github.com/jhejna/cpl

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.02620 2024-04-22 cs.LG cs.AI 62%

Dynamic Observation Policies in Observation Cost-Sensitive Reinforcement Learning

Colin Bellinger, Mark Crowley, Isaac Tamblyn

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2023 Workshop WANT

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.17722 2024-04-17 cs.LG cs.AI cs.CL 62%

Large Language Models as Generalizable Policies for Embodied Tasks

Andrew Szot, Max Schwarzer, Harsh Agrawal, Bogdan Mazoure, Walter Talbott, Katherine Metcalf, Natalie Mackraz, Devon Hjelm, Alexander Toshev

专题命中 模仿学习与强化学习 :embodied AI(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.05332 2024-04-10 eess.SY cs.LG cs.RO cs.SY math.OC 62%

MPC-Inspired Reinforcement Learning for Verifiable Model-Free Control

Yiwen Lu, Zishuo Li, Yihan Zhou, Na Li, Yilin Mo

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05440 2024-04-09 cs.AI cs.LG 62%

Tree Search-Based Policy Optimization under Stochastic Execution Delay

David Valensi, Esther Derman, Shie Mannor, Gal Dalal

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Published in ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00344 2024-04-02 cs.RO cs.LG 62%

Robustifying a Policy in Multi-Agent RL with Diverse Cooperative Behaviors and Adversarial Style Sampling for Assistive Tasks

Takayuki Osa, Tatsuya Harada

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments 7 pages, accepted for ICRA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15091 2024-03-25 cs.LG cs.AI cs.SY eess.SY 62%

Improved Long Short-Term Memory-based Wastewater Treatment Simulators for Deep Reinforcement Learning

Esmaeel Mohammadi, Daniel Ortiz-Arroyo, Mikkel Stokholm-Bjerregaard, Aviaja Anna Hansen, Petar Durdevic

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.04688 2024-03-21 cs.LG cs.AI cs.CR 62%

BAFFLE: Hiding Backdoors in Offline Reinforcement Learning Datasets

Chen Gong, Zhou Yang, Yunpeng Bai, Junda He, Jieke Shi, Kecen Li, Arunesh Sinha, Bowen Xu, Xinwen Hou, David Lo, Tianhao Wang

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments Accepted at IEEE S&P (Oakland) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.10243 2024-03-18 cs.LG cs.AI 62%

CLUTR: Curriculum Learning via Unsupervised Task Representation Learning

Abdus Salam Azad, Izzeddin Gur, Jasper Emhoff, Nathaniel Alexis, Aleksandra Faust, Pieter Abbeel, Ion Stoica

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments Preprint, Currently Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07916 2024-03-14 cs.AI cs.LG 62%

Advancing Investment Frontiers: Industry-grade Deep Reinforcement Learning for Portfolio Optimization

Philip Ndikum, Serge Ndikum

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03643 2024-03-08 cs.LG cs.AI 62%

A Survey on Applications of Reinforcement Learning in Spatial Resource Allocation

Di Zhang, Moyang Wang, Joseph Mango, Xiang Li, Xianrui Xu

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.01282 2024-03-04 cs.LG cs.AI econ.EM stat.ML 62%

Structural Estimation of Markov Decision Processes in High-Dimensional State Space with Finite-Time Guarantees

Siliang Zeng, Mingyi Hong, Alfredo Garcia

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments This conference version of this paper refers to "Maximum-Likelihood Inverse Reinforcement Learning with Finite-Time Guarantees" in NeurIPS 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17135 2024-02-28 cs.LG cs.AI 62%

Unsupervised Zero-Shot Reinforcement Learning via Functional Reward Encodings

Kevin Frans, Seohong Park, Pieter Abbeel, Sergey Levine

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.04241 2024-02-19 cs.LG cs.AI 62%

Improving Reinforcement Learning Efficiency with Auxiliary Tasks in Non-Visual Environments: A Comparison

Moritz Lange, Noah Krystiniak, Raphael C. Engelhardt, Wolfgang Konen, Laurenz Wiskott

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Accepted at LOD 2023

Journal ref Machine Learning, Optimization, and Data Science. LOD 2023. Lecture Notes in Computer Science, vol 14506. Springer, Cham

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09355 2024-02-15 cs.RO cs.AI 62%

Single-Reset Divide & Conquer Imitation Learning

Alexandre Chenu, Olivier Serris, Olivier Sigaud, Nicolas Perrin-Gilbert

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09290 2024-02-15 cs.LG cs.AI 62%

Learning Interpretable Policies in Hindsight-Observable POMDPs through Partially Supervised Reinforcement Learning

Michael Lanier, Ying Xu, Nathan Jacobs, Chongjie Zhang, Yevgeniy Vorobeychik

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19668 2024-02-15 cs.LG cs.CV 62%

DrM: Mastering Visual Reinforcement Learning through Dormant Ratio Minimization

Guowei Xu, Ruijie Zheng, Yongyuan Liang, Xiyao Wang, Zhecheng Yuan, Tianying Ji, Yu Luo, Xiaoyu Liu, Jiaxin Yuan, Pu Hua, Shuzhen Li, Yanjie Ze, Hal Daumé, Furong Huang, Huazhe Xu

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.CV、cs.LG

Comments Accepted at The Twelfth International Conference on Learning Representations (ICLR 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07412 2024-02-13 cs.LG cs.AI 62%

Auxiliary Reward Generation with Transition Distance Representation Learning

Siyuan Li, Shijie Han, Yingnan Zhao, By Liang, Peng Liu

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06023 2024-02-12 cs.LG cs.AI cs.GT 62%

Decision Theory-Guided Deep Reinforcement Learning for Fast Learning

Zelin Wan, Jin-Hee Cho, Mu Zhu, Ahmed H. Anwar, Charles Kamhoua, Munindar P. Singh

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03072 2024-02-06 q-bio.NC cs.AI cs.LG 62%

Learning to Abstract Visuomotor Mappings using Meta-Reinforcement Learning

Carlos A. Velazquez-Vargas, Isaac Ray Christian, Jordan A. Taylor, Sreejan Kumar

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13795 2024-01-31 cs.LG cs.AI 62%

Proximal Policy Gradient Arborescence for Quality Diversity Reinforcement Learning

Sumeet Batra, Bryon Tjanaka, Matthew C. Fontaine, Aleksei Petrenko, Stefanos Nikolaidis, Gaurav Sukhatme

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.AI、cs.LG

Comments Accepted as a spotlight paper at ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.06236 2024-01-30 cs.LG cs.AI 62%

Efficient Deep Reinforcement Learning with Predictive Processing Proximal Policy Optimization

Burcu Küçükoğlu, Walraaf Borkent, Bodo Rueckauer, Nasir Ahmad, Umut Güçlü, Marcel van Gerven

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

Comments 24 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12975 2024-01-24 cs.CV cs.AI cs.CL 62%

HAZARD Challenge: Embodied Decision Making in Dynamically Changing Environments

Qinhong Zhou, Sunli Chen, Yisong Wang, Haozhe Xu, Weihua Du, Hongxin Zhang, Yilun Du, Joshua B. Tenenbaum, Chuang Gan

专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.AI、cs.CV

Comments ICLR 2024. The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10309 2024-01-24 cs.LG cs.RO 62%

Imagination-Augmented Hierarchical Reinforcement Learning for Safe and Interactive Autonomous Driving in Urban Environments

Sang-Hyun Lee, Yoonjae Jung, Seung-Woo Seo

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments 15 pages, 9 figures; corrected typos, added references, revised experiments (results unchanged)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.04073 2024-01-23 cs.AI cs.LG 62%

Explaining RL Decisions with Trajectories

Shripad Vilasrao Deshmukh, Arpan Dasgupta, Balaji Krishnamurthy, Nan Jiang, Chirag Agarwal, Georgios Theocharous, Jayakumar Subramanian

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments Published at International Conference on Learning Representations (ICLR), 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13326 2024-01-17 cs.LG cs.AI q-fin.PM 62%

Curriculum Learning and Imitation Learning for Model-free Control on Financial Time-series

Woosung Koh, Insu Choi, Yuntae Jang, Gimin Kang, Woo Chang Kim

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments AAAI 2024 AI4TS Workshop Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17168 2023-12-29 cs.LG cs.AI 62%

Can Active Sampling Reduce Causal Confusion in Offline Reinforcement Learning?

Gunshi Gupta, Tim G. J. Rudner, Rowan Thomas McAllister, Adrien Gaidon, Yarin Gal

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Published in Proceedings of the 2nd Conference on Causal Learning and Reasoning (CLeaR 2021)

详情

展开后加载摘要…

URL PDF HTML 收藏