arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4113 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4113 篇

2107.12931 2021-10-29 cs.LG cs.AI cs.RO 67%

Autonomous Reinforcement Learning via Subgoal Curricula

Archit Sharma, Abhishek Gupta, Sergey Levine, Karol Hausman, Chelsea Finn

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.00771 2021-09-29 physics.flu-dyn cs.AI cs.LG cs.RO 67%

Learning swimming escape patterns for larval fish under energy constraints

Ioannis Mandralis, Pascal Weber, Guido Novati, Petros Koumoutsakos

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI、cs.LG

Journal ref Phys. Rev. Fluids 6, 093101 (2021)

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.12956 2021-09-21 cs.LG cs.AI cs.RO cs.SY eess.SY 67%

Reinforcement Learning for Robust Missile Autopilot Design

Bernardo Cortez

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI、cs.LG

Comments ICRLCT 2021 conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.12344 2021-09-14 cs.LG cs.AI cs.RO 67%

Memory-based Deep Reinforcement Learning for POMDPs

Lingheng Meng, Rob Gorbet, Dana Kulić

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

Comments 15 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.03169 2021-08-09 eess.SP cs.AI cs.LG cs.RO cs.SY eess.SY 67%

Responding to Illegal Activities Along the Canadian Coastlines Using Reinforcement Learning

Mohammed Abouheaf, Shuzheng Qu, Wail Gueaieb, Rami Abielmona, Moufid Harb

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG

Journal ref IEEE Instrumentation & Measurement Magazine, vol. 24, no. 2, pp. 118-126, April 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.05150 2021-08-05 cs.CL cs.AI cs.LG cs.RO 67%

Safe Reinforcement Learning with Natural Language Constraints

Tsung-Yen Yang, Michael Hu, Yinlam Chow, Peter J. Ramadge, Karthik Narasimhan

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

Comments The first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.09189 2021-08-03 cs.RO cs.AI cs.CV 67%

Goal-constrained Sparse Reinforcement Learning for End-to-End Driving

Pranav Agarwal, Pierre de Beaucorps, Raoul de Charette

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI、cs.CV

Comments Conference submission 6 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.02339 2021-07-07 cs.LG cs.AI cs.RO 67%

Multi-Modal Mutual Information (MuMMI) Training for Robust Self-Supervised Deep Reinforcement Learning

Kaiqi Chen, Yong Lee, Harold Soh

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.RO、cs.AI、cs.LG

Comments 10 pages, Published in ICRA 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.10456 2021-07-02 cs.LG cs.AI cs.RO 67%

Decaying Clipping Range in Proximal Policy Optimization

Mónika Farsang, Luca Szegletes

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI、cs.LG

Journal ref 2021 IEEE 15th International Symposium on Applied Computational Intelligence and Informatics (SACI), 2021, pp. 000521-000526

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.12895 2021-06-25 cs.LG cs.AI cs.RO 67%

rSoccer: A Framework for Studying Reinforcement Learning in Small and Very Small Size Robot Soccer

Felipe B. Martins, Mateus G. Machado, Hansenclever F. Bassani, Pedro H. M. Braga, Edna S. Barros

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.09938 2021-06-23 cs.LG cs.AI cs.RO 67%

Goal-Directed Planning by Reinforcement Learning and Active Inference

Dongqi Han, Kenji Doya, Jun Tani

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.09461 2021-06-18 cs.LG cs.AI cs.MA cs.RO cs.SY eess.SY 67%

Modelling resource allocation in uncertain system environment through deep reinforcement learning

Neel Gandhi, Shakti Mishra

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

Comments Accepted at IRMAS'21

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.07643 2021-06-15 cs.LG cs.CV cs.RO 67%

Unsupervised Learning of Visual 3D Keypoints for Control

Boyuan Chen, Pieter Abbeel, Deepak Pathak

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.CV、cs.LG

Comments Accepted at ICML 2021. Videos and code at https://buoyancy99.github.io/unsup-3d-keypoints/

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.06517 2021-05-17 cs.AI cs.LG cs.RO 67%

Reinforcement Learning Based Safe Decision Making for Highway Autonomous Driving

Arash Mohammadhasani, Hamed Mehrivash, Alan Lynch, Zhan Shu

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.11707 2021-04-26 cs.LG cs.AI cs.RO 67%

DisCo RL: Distribution-Conditioned Reinforcement Learning for General-Purpose Policies

Soroush Nasiriany, Vitchyr H. Pong, Ashvin Nair, Alexander Khazatsky, Glen Berseth, Sergey Levine

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

Comments ICRA 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.06511 2021-04-07 cs.NE cs.AI cs.LG cs.RO 67%

Reinforcement Learning with Chromatic Networks for Compact Architecture Search

Xingyou Song, Krzysztof Choromanski, Jack Parker-Holder, Yunhao Tang, Wenbo Gao, Aldo Pacchiano, Tamas Sarlos, Deepali Jain, Yuxiang Yang

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

Comments Published at ICLR 2020 Neural Architecture Search Workshop. This paper is deprecated; please see arXiv:2101.07415 for the newer version

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.05556 2021-03-18 cs.LG cs.AI cs.RO cs.SY eess.SY stat.ML 67%

Model-Based Offline Planning

Arthur Argenson, Gabriel Dulac-Arnold

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.07013 2021-03-15 cs.LG cs.AI cs.CV cs.GR 67%

Large Batch Simulation for Deep Reinforcement Learning

Brennan Shacklett, Erik Wijmans, Aleksei Petrenko, Manolis Savva, Dhruv Batra, Vladlen Koltun, Kayvon Fatahalian

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.CV、cs.LG

Comments Published as a conference paper at ICLR 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.07804 2021-03-12 cs.LG cs.AI cs.RO stat.ML 67%

A Game Theoretic Framework for Model Based Reinforcement Learning

Aravind Rajeswaran, Igor Mordatch, Vikash Kumar

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

Comments ICML 2020. This version contains expanded discussion, hyperparameter configurations, and ablation studies

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.13100 2021-02-26 cs.LG cs.AI cs.RO 67%

Task-Agnostic Morphology Evolution

Donald J. Hejna, Pieter Abbeel, Lerrel Pinto

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

Comments ICLR 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.07266 2021-02-16 cs.LG cs.AI cs.RO stat.ML 67%

Sparse Attention Guided Dynamic Value Estimation for Single-Task Multi-Scene Reinforcement Learning

Jaskirat Singh, Liang Zheng

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG

Comments This work is a merger of arXiv:2005.12254 and arXiv:2011.12574

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.05970 2021-01-18 cs.LG cs.AI cs.RO 67%

Affordance-based Reinforcement Learning for Urban Driving

Tanmay Agarwal, Hitesh Arora, Jeff Schneider

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.06782 2020-12-23 cs.LG cs.CV cs.RO stat.ML 67%

Gradient Surgery for Multi-Task Learning

Tianhe Yu, Saurabh Kumar, Abhishek Gupta, Sergey Levine, Karol Hausman, Chelsea Finn

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.CV、cs.LG

Comments NeurIPS 2020. Code is available at https://github.com/tianheyu927/PCGrad

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.12361 2020-12-22 cs.AI cs.LG cs.RO 67%

Sub-Goal Trees -- a Framework for Goal-Based Reinforcement Learning

Tom Jurgenson, Or Avner, Edward Groshev, Aviv Tamar

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

Comments ICML2020, 8 pages, 10 figures. arXiv admin note: text overlap with arXiv:1906.05329

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.06733 2020-12-15 cs.RO cs.AI cs.LG 67%

Human-in-the-Loop Imitation Learning using Remote Teleoperation

Ajay Mandlekar, Danfei Xu, Roberto Martín-Martín, Yuke Zhu, Li Fei-Fei, Silvio Savarese

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.02863 2020-12-07 cs.LG cs.AI cs.RO stat.ML 67%

Counterfactual Data Augmentation using Locally Factored Dynamics

Silviu Pitis, Elliot Creager, Animesh Garg

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI、cs.LG

Comments In Proceedings of NeurIPS 2020. 10 pages (+5 references, +12 appendix). Code available at \url{https://github.com/spitis/mrl}

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.13052 2020-11-24 cs.LG cs.CV cs.NE cs.RO stat.ML 67%

GENESIS: Generative Scene Inference and Sampling with Object-Centric Latent Representations

Martin Engelcke, Adam R. Kosiorek, Oiwi Parker Jones, Ingmar Posner

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.CV、cs.LG

Comments Published at the International Conference on Learning Representations (ICLR) 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.09004 2020-11-19 cs.LG cs.AI cs.HC cs.NE cs.RO 67%

Explaining Conditions for Reinforcement Learning Behaviors from Real and Imagined Data

Aastha Acharya, Rebecca Russell, Nisar R. Ahmed

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.RO、cs.AI、cs.LG

Comments Accepted to the Workshop on Challenges of Real-World RL at NeurIPS 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.08726 2020-11-18 cs.LG cs.CV cs.RO 67%

Modality-Buffet for Real-Time Object Detection

Nicolai Dorka, Johannes Meyer, Wolfram Burgard

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.CV、cs.LG

Comments Accepted at the 2020 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.08541 2020-11-18 cs.LG cs.AI cs.RO 67%

Efficient Exploration of Reward Functions in Inverse Reinforcement Learning via Bayesian Optimization

Sreejith Balakrishnan, Quoc Phong Nguyen, Bryan Kian Hsiang Low, Harold Soh

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.RO、cs.AI、cs.LG

Comments Accepted to 34th Conference on Neural Information Processing Systems (NeurIPS 2020). Includes Appendix. 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏