arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4116 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4116 篇

2205.05569 2022-05-12 cs.LG 57%

Delayed Reinforcement Learning by Imitation

Pierre Liotet, Davide Maran, Lorenzo Bisi, Marcello Restelli

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.03471 2022-05-10 cond-mat.soft cs.LG physics.comp-ph 57%

Dynamically writing coupled memories using a reinforcement learning agent, meeting physical bounds

Théo Jules, Laura Michel, Adèle Douin, Frédéric Lechenault

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

Comments Main text: 5 pages, 4 figures. Submitted to PNAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.03880 2022-05-05 eess.SY cs.RO cs.SY 57%

Integrated and Adaptive Guidance and Control for Endoatmospheric Missiles via Reinforcement Learning

Brian Gaudet, Roberto Furfaro

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

Comments Preprint for 2023 Scitech GN&C submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.14457 2022-05-03 cs.LG 57%

Direct then Diffuse: Incremental Unsupervised Skill Discovery for State Covering and Goal Reaching

Pierre-Alexandre Kamienny, Jean Tarbouriech, Sylvain Lamprier, Alessandro Lazaric, Ludovic Denoyer

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments ICLR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.07409 2022-05-02 math.OC cs.LG math.AG 57%

The Geometry of Memoryless Stochastic Policy Optimization in Infinite-Horizon POMDPs

Johannes Müller, Guido Montúfar

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments Camera ready version for ICLR 2022, 45 pages, 8 figures

Journal ref Proceedings of the 10th International Conference on Learning Representations (ICLR 2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.11475 2022-04-26 cs.RO 57%

Adaptive actuation of magnetic soft robots using deep reinforcement learning

Jianpeng Yao, Quanliang Cao, Yuwei Ju, Yuxuan Sun, Ruiqi Liu, Xiaotao Han, Liang Li

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.12991 2022-04-25 cs.LG 57%

Optimistic Reinforcement Learning by Forward Kullback-Leibler Divergence Optimization

Taisuke Kobayashi

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments 14 pages, 6 figures

Journal ref Neural Networks, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.08516 2022-04-13 cs.RO cs.SY eess.SY 57%

Safety-Aware Preference-Based Learning for Safety-Critical Control

Ryan K. Cosner, Maegan Tucker, Andrew J. Taylor, Kejun Li, Tamás G. Molnár, Wyatt Ubellacker, Anil Alan, Gábor Orosz, Yisong Yue, Aaron D. Ames

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.04823 2022-04-12 cs.RO 57%

ACuTE: Automatic Curriculum Transfer from Simple to Complex Environments

Yash Shukla, Christopher Thierauf, Ramtin Hosseini, Gyan Tatiya, Jivko Sinapov

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.15290 2022-03-30 cs.RO 57%

Design strategies for controlling neuron-connected robots using reinforcement learning

Haruto Sawada, Naoki Wake, Kazuhiro Sasabuchi, Jun Takamatsu, Hirokazu Takahashi, Katsushi Ikeuchi

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

Comments Last updated March 29th, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.14033 2022-03-29 cs.RO cs.SY eess.SY 57%

Aggressive Quadrotor Flight Using Curiosity-Driven Reinforcement Learning

Qiyu Sun, Jinbao Fang, Wei Xing Zheng, Yang Tang

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.11842 2022-03-23 cs.LG 57%

X-MEN: Guaranteed XOR-Maximum Entropy Constrained Inverse Reinforcement Learning

Fan Ding, Yeiang Xue

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.11369 2022-03-23 cs.LG 57%

Temporal Abstractions-Augmented Temporally Contrastive Learning: An Alternative to the Laplacian in RL

Akram Erraqabi, Marlos C. Machado, Mingde Zhao, Sainbayar Sukhbaatar, Alessandro Lazaric, Ludovic Denoyer, Yoshua Bengio

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.09637 2022-03-21 cs.LG 57%

Investigating Compounding Prediction Errors in Learned Dynamics Models

Nathan Lambert, Kristofer Pister, Roberto Calandra

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments 25 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.08389 2022-03-16 cs.RO cs.SY eess.SY 57%

Analysis of Model-Free Reinforcement Learning Control Schemes on self-balancing Wheeled Extendible System

Kanishk ., Rushil Kumar, Vikas Rastogi, Ajeet Kumar

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.05360 2022-03-11 cs.RO cs.SY eess.SY 57%

Deep Residual Reinforcement Learning based Autonomous Blimp Control

Yu Tang Liu, Eric Price, Michael J. Black, Aamir Ahmad

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.03917 2022-03-09 cs.LG 57%

An Analysis of Measure-Valued Derivatives for Policy Gradients

Joao Carvalho, Jan Peters

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.05120 2022-03-07 cs.RO 57%

TERP: Reliable Planning in Uneven Outdoor Environments using Deep Reinforcement Learning

Kasun Weerakoon, Adarsh Jagan Sathyamoorthy, Utsav Patel, Dinesh Manocha

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.10915 2022-03-01 cs.LG cs.MA 57%

Multi-Agent Reinforcement Learning for Markov Routing Games: A New Modeling Paradigm For Dynamic Traffic Assignment

Zhenyu Shou, Xu Chen, Yongjie Fu, Xuan Di

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments 20 pages, 11 figures, published in Transportation Research Part C 137 (2022) 103560

Journal ref Transportation Research Part C: Emerging Technologies 137, 103560 (2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.12260 2022-02-25 cs.AI 57%

Self-organising Urban Traffic control on micro-level using Reinforcement Learning and Agent-based Modelling

Stefan Bosse

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.06003 2022-02-16 cs.LG 57%

Robust Learning from Observation with Model Misspecification

Luca Viano, Yu-Ting Huang, Parameswaran Kamalaruban, Craig Innes, Subramanian Ramamoorthy, Adrian Weller

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments accepted to AAMAS 2022 (camera-ready version)

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.06466 2022-02-16 cs.RO 57%

Imitation learning for variable speed motion generation over multiple actions

Yuki Saigusa, Ayumu Sasagawa, Sho Sakaino, Toshiaki Tsuji

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments Copyright 2021 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works

Journal ref IECON 2021 47th Annual Conference of the IEEE Industrial Electronics Society, Oct. 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.04836 2022-02-15 cs.LG math.DS physics.data-an stat.ML 57%

Deconstructing the Inductive Biases of Hamiltonian Neural Networks

Nate Gruver, Marc Finzi, Samuel Stanton, Andrew Gordon Wilson

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments ICLR 2022. Code available at https://github.com/ngruver/decon-hnn

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.06496 2022-02-03 cs.LG cs.CR stat.ML 57%

Certifiable Robustness to Adversarial State Uncertainty in Deep Reinforcement Learning

Michael Everett, Bjorn Lutjens, Jonathan P. How

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments arXiv admin note: text overlap with arXiv:1910.12908

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.01993 2022-01-21 cs.RO 57%

A Survey of Deep RL and IL for Autonomous Driving Policy Learning

Zeyu Zhu, Huijing Zhao

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.11015 2022-01-20 cs.IT cs.LG eess.SP math.IT 57%

Trajectory Design for UAV-Based Internet-of-Things Data Collection: A Deep Reinforcement Learning Approach

Yang Wang, Zhen Gao, Jun Zhang, Xianbin Cao, Dezhi Zheng, Yue Gao, Derrick Wing Kwan Ng, Marco Di Renzo

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments Accepted by IEEE Internet of Things Journal. The codes and some other materials about this work may be available at https://gaozhen16.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.13524 2022-01-19 cs.LG 57%

Improving Generalization in Meta-RL with Imaginary Tasks from Latent Dynamics Mixture

Suyoung Lee, Sae-Young Chung

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments NeurIPS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.05753 2022-01-19 cs.RO 57%

Parameter Identification and Motion Control for Articulated Rigid Body Robots Using Differentiable Position-based Dynamics

Fei Liu, Mingen Li, Jingpei Lu, Entong Su, Michael C. Yip

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

Comments 15pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.15092 2022-01-19 cs.LG 57%

A Law of Iterated Logarithm for Multi-Agent Reinforcement Learning

Gugan Thoppe, Bhumesh Kumar

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments Some typos corrected; 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.09101 2022-01-14 eess.SY cs.LG cs.SY math.OC 57%

Safe Policies for Reinforcement Learning via Primal-Dual Methods

Santiago Paternain, Miguel Calvo-Fullana, Luiz F. O. Chamon, Alejandro Ribeiro

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments arXiv admin note: text overlap with arXiv:1910.13393

详情

展开后加载摘要…

URL PDF HTML 收藏