arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4115 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4115 篇

2005.12254 2020-05-26 cs.LG cs.AI stat.ML 62%

Dynamic Value Estimation for Single-Task Multi-Scene Reinforcement Learning

Jaskirat Singh, Liang Zheng

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.02982 2020-05-26 cs.LG cs.AI cs.HC cs.NE stat.ML 62%

DRLViz: Understanding Decisions and Memory in Deep Reinforcement Learning

Theo Jaunet, Romain Vuillemot, Christian Wolf

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.03233 2020-05-08 cs.LG cs.AI 62%

Safe Reinforcement Learning through Meta-learned Instincts

Djordje Grbic, Sebastian Risi

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.02153 2020-05-07 cs.LG cs.RO stat.ML 62%

Information Theoretic Model Predictive Q-Learning

Mohak Bhardwaj, Ankur Handa, Dieter Fox, Byron Boots

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

Comments Extended version (15 pages) of paper accepted at the 2nd Learning for Dynamics and Control (L4DC) Conference, 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.07276 2020-05-05 eess.SY cs.LG cs.RO cs.SY 62%

Improving Input-Output Linearizing Controllers for Bipedal Robots via Reinforcement Learning

Fernando Castañeda, Mathias Wulfman, Ayush Agrawal, Tyler Westenbroek, Claire J. Tomlin, S. Shankar Sastry, Koushil Sreenath

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments Final version appearing in Learning for Dynamics and Control (L4DC) 2020 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.12846 2020-04-29 cs.NE cs.AI cs.LG 62%

Evolving Inborn Knowledge For Fast Adaptation in Dynamic POMDP Problems

Eseoghene Ben-Iwhiwhu, Pawel Ladosz, Jeffery Dick, Wen-Hua Chen, Praveen Pilly, Andrea Soltoggio

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments 9 pages. Accepted as a full paper in the Genetic and Evolutionary Computation Conference (GECCO 2020)

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.11410 2020-04-27 cs.LG cs.AI stat.ML 62%

Divide-and-Conquer Monte Carlo Tree Search For Goal-Directed Planning

Giambattista Parascandolo, Lars Buesing, Josh Merel, Leonard Hasenclever, John Aslanides, Jessica B. Hamrick, Nicolas Heess, Alexander Neitz, Theophane Weber

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.10698 2020-04-24 cs.LG cs.AI 62%

AutoEG: Automated Experience Grafting for Off-Policy Deep Reinforcement Learning

Keting Lu, Shiqi Zhang, Xiaoping Chen

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.02945 2020-04-24 cs.LG cs.MA cs.RO stat.ML 62%

A pedestrian path-planning model in accordance with obstacle's danger with reinforcement learning

Thanh-Trung Trinh, Dinh-Minh Vu, Masaomi Kimura

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.13272 2020-04-23 math.OC cs.AI cs.LG cs.SY eess.SY 62%

Feedback Linearization for Unknown Systems via Reinforcement Learning

Tyler Westenbroek, David Fridovich-Keil, Eric Mazumdar, Shreyas Arora, Valmik Prabhu, S. Shankar Sastry, Claire J. Tomlin

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.02762 2020-04-07 cs.LG cs.AI 62%

Using Generative Adversarial Nets on Atari Games for Feature Extraction in Deep Reinforcement Learning

Ayberk Aydın, Elif Surer

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments in Turkish

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.11126 2020-03-26 cs.LG cs.AI stat.ML 62%

Black-box Off-policy Estimation for Infinite-Horizon Reinforcement Learning

Ali Mousavi, Lihong Li, Qiang Liu, Denny Zhou

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Published at ICLR 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.07417 2020-03-18 cs.LG cs.AI cs.NE 62%

Improving Performance in Reinforcement Learning by Breaking Generalization in Neural Networks

Sina Ghiassian, Banafsheh Rafiee, Yat Long Lo, Adam White

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments 10 pages; Accepted to AAMAS 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.02637 2020-03-06 cs.RO cs.LG 62%

Whole-Body Control of a Mobile Manipulator using End-to-End Reinforcement Learning

Julien Kindle, Fadri Furrer, Tonci Novkovic, Jen Jen Chung, Roland Siegwart, Juan Nieto

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

Comments 6 pages, 6 figures, 2 tables, submitted to RA-L/IROS

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.02636 2020-03-06 cs.RO cs.LG stat.ML 62%

Scalable Multi-Task Imitation Learning with Autonomous Improvement

Avi Singh, Eric Jang, Alexander Irpan, Daniel Kappler, Murtaza Dalal, Sergey Levine, Mohi Khansari, Chelsea Finn

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.RO、cs.LG

Comments Accepted to ICRA 2020. Supplementary material at https://sites.google.com/view/scalable-mili

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.13607 2020-03-05 cs.LG cs.AI stat.ML 62%

MGHRL: Meta Goal-generation for Hierarchical Reinforcement Learning

Haotian Fu, Hongyao Tang, Jianye Hao, Wulong Liu, Chen Chen

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Accepted to the ICLR 2020 workshop: Beyond tabula rasa in RL (BeTR-RL)

详情

展开后加载摘要…

URL PDF HTML 收藏
1903.05751 2020-03-05 stat.ML cs.LG cs.RO 62%

Trajectory Optimization for Unknown Constrained Systems using Reinforcement Learning

Kei Ota, Devesh K. Jha, Tomoaki Oiki, Mamoru Miura, Takashi Nammoto, Daniel Nikovski, Toshisada Mariyama

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments 8 pages, 6 figures, Accepted to IROS 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.10621 2020-02-26 cs.LG cs.RO cs.SY eess.SP eess.SY stat.ML 62%

Model-Based Reinforcement Learning for Physical Systems Without Velocity and Acceleration Measurements

Alberto Dalla Libera, Diego Romeres, Devesh K. Jha, Bill Yerazunis, Daniel Nikovski

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments Accepted at RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.09884 2020-02-25 cs.LG cs.AI stat.ML 62%

Discriminative Particle Filter Reinforcement Learning for Complex Partial Observations

Xiao Ma, Peter Karkus, David Hsu, Wee Sun Lee, Nan Ye

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments Accepted to ICLR 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.08242 2020-02-20 cs.CV cs.AI 62%

AI Online Filters to Real World Image Recognition

Hai Xiao, Jin Shang, Mengyuan Huang

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.07956 2020-02-20 cs.LG cs.AI stat.ML 62%

Curriculum in Gradient-Based Meta-Reinforcement Learning

Bhairav Mehta, Tristan Deleu, Sharath Chandra Raparthy, Chris J. Pal, Liam Paull

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments 11 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.07516 2020-02-12 cs.LG cs.AI stat.ML 62%

Robust Reinforcement Learning for Continuous Control with Model Misspecification

Daniel J. Mankowitz, Nir Levine, Rae Jeong, Yuanyuan Shi, Jackie Kay, Abbas Abdolmaleki, Jost Tobias Springenberg, Timothy Mann, Todd Hester, Martin Riedmiller

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.01032 2020-02-04 cs.LG cs.CR cs.CV stat.ML 62%

Reinforcement Learning with Perturbed Rewards

Jingkang Wang, Yang Liu, Bo Li

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.CV、cs.LG

Comments AAAI 2020 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.03792 2020-01-14 cs.AI cs.RO 62%

Reward Engineering for Object Pick and Place Training

Raghav Nagpal, Achyuthan Unni Krishnan, Hanshen Yu

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.12392 2020-01-09 cs.LG cs.AI stat.ML 62%

A Unified Bellman Optimality Principle Combining Reward Maximization and Empowerment

Felix Leibfried, Sergio Pascual-Diaz, Jordi Grau-Moya

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Proceedings of the 33rd Conference on Neural Information Processing Systems (NeurIPS), Vancouver, Canada, 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.12639 2020-01-01 eess.SY cs.AI cs.MA cs.RO cs.SY 62%

MAMPS: Safe Multi-Agent Reinforcement Learning via Model Predictive Shielding

Wenbo Zhang, Osbert Bastani, Vijay Kumar

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.11531 2019-12-30 cs.CR cs.AI cs.LG 62%

Pseudo Random Number Generation: a Reinforcement Learning approach

Luca Pasqualini, Maurizio Parton

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments 13 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.01465 2019-12-03 cs.LG cs.AI cs.MA stat.ML 62%

Reducing Overestimation Bias in Multi-Agent Domains Using Double Centralized Critics

Johannes Ackermann, Volker Gabler, Takayuki Osa, Masashi Sugiyama

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments Accepted for the Deep RL Workshop at NeurIPS 2019; Changes for v2: Changed Figures 3,4, due to an error in the implementation of MATD3. Please refer to this version for fair evaluation

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.10641 2019-12-03 cs.LG cs.AI math.OC 62%

ORL: Reinforcement Learning Benchmarks for Online Stochastic Optimization Problems

Bharathan Balaji, Jordan Bell-Masterson, Enes Bilgin, Andreas Damianou, Pablo Moreno Garcia, Arpit Jain, Runfei Luo, Alvaro Maggiar, Balakrishnan Narayanaswamy, Chun Ye

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1903.00401 2019-11-25 cs.AI cs.CL cs.CV 62%

Learning To Follow Directions in Street View

Karl Moritz Hermann, Mateusz Malinowski, Piotr Mirowski, Andras Banki-Horvath, Keith Anderson, Raia Hadsell

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.CV

Journal ref AAAI 2020

详情

展开后加载摘要…

URL PDF HTML 收藏