arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4115 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4115 篇

2312.16365 2023-12-29 cs.LG cs.AI stat.ML 62%

Active Third-Person Imitation Learning

Timo Klein, Susanna Weinberger, Adish Singla, Sebastian Tschiatschek

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.10923 2023-12-27 cs.LG cs.AI 62%

Trust Region-Based Safe Distributional Reinforcement Learning for Multiple Constraints

Dohyeong Kim, Kyungjae Lee, Songhwai Oh

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments 32 pages, Accepted at NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10802 2023-12-19 cs.LG cs.AI 62%

GO-DICE: Goal-Conditioned Option-Aware Offline Imitation Learning via Stationary Distribution Correction Estimation

Abhinav Jain, Vaibhav Unhelkar

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments Extended version of an identically-titled paper accepted at AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10328 2023-12-19 cs.RO cs.LG cs.LO 62%

Deriving Rewards for Reinforcement Learning from Symbolic Behaviour Descriptions of Bipedal Walking

Daniel Harnack, Christoph Lüth, Lukas Gross, Shivesh Kumar, Frank Kirchner

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

Comments To appear in 62nd IEEE Conference on Decision and Control (CDC). For supplemental material, see here https://dfki-ric-underactuated-lab.github.io/orthant_rewards_biped_rl/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10289 2023-12-19 cs.LG cs.AI cs.SY eess.SY 62%

Active Reinforcement Learning for Robust Building Control

Doseok Jang, Larry Yan, Lucas Spangher, Costas Spanos

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09906 2023-12-18 cs.RO cs.AI 62%

Sample-Efficient Learning to Solve a Real-World Labyrinth Game Using Data-Augmented Model-Based Reinforcement Learning

Thomas Bi, Raffaello D'Andrea

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08875 2023-12-12 cs.LG cs.RO math.OC 62%

Natural Actor-Critic for Robust Reinforcement Learning with Function Approximation

Ruida Zhou, Tao Liu, Min Cheng, Dileep Kalathil, P. R. Kumar, Chao Tian

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments Neurips 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01804 2023-12-12 cs.LG cs.AI 62%

Extracting Reward Functions from Diffusion Models

Felipe Nuti, Tim Franzmeyer, João F. Henriques

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.08642 2023-12-12 cs.RO cs.AI 62%

POAR: Efficient Policy Optimization via Online Abstract State Representation Learning

Zhaorun Chen, Siqi Fan, Yuan Tan, Liang Gong, Binhao Chen, Te Sun, David Filliat, Natalia Díaz-Rodríguez, Chengliang Liu

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00966 2023-12-11 cs.LG cs.AI 62%

Spectral Temporal Contrastive Learning

Sacha Morin, Somjit Nath, Samira Ebrahimi Kahou, Guy Wolf

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Accepted to Self-Supervised Learning - Theory and Practice, NeurIPS Workshop, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02649 2023-12-06 cs.RO cs.LG 62%

A Q-learning approach to the continuous control problem of robot inverted pendulum balancing

Mohammad Safeea, Pedro Neto

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.02016 2023-12-06 cs.LG cs.AI cs.SY eess.SY 62%

Robust Reinforcement Learning in Continuous Control Tasks with Uncertainty Set Regularization

Yuan Zhang, Jianhong Wang, Joschka Boedecker

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Accepted at CoRL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01249 2023-12-05 cs.RO cs.AI cs.SY eess.SY 62%

A Multifidelity Sim-to-Real Pipeline for Verifiable and Compositional Reinforcement Learning

Cyrus Neary, Christian Ellis, Aryaman Singh Samyal, Craig Lennon, Ufuk Topcu

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19308 2023-12-05 cs.LG cs.AI 62%

Free from Bellman Completeness: Trajectory Stitching via Model-based Return-conditioned Supervised Learning

Zhaoyi Zhou, Chuning Zhu, Runlong Zhou, Qiwen Cui, Abhishek Gupta, Simon Shaolei Du

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.10936 2023-12-05 cs.AI cs.LG 62%

PASTA: Pretrained Action-State Transformer Agents

Raphael Boige, Yannis Flet-Berliac, Arthur Flajolet, Guillaume Richard, Thomas Pierrot

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09233 2023-11-17 cs.LG cs.GR cs.RO 62%

Neural Packing: from Visual Sensing to Reinforcement Learning

Juzhan Xu, Minglun Gong, Hao Zhang, Hui Huang, Ruizhen Hu

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.03669 2023-11-08 cs.LG cs.AI cs.SY eess.SY 62%

Stable Modular Control via Contraction Theory for Reinforcement Learning

Bing Song, Jean-Jacques Slotine, Quang-Cuong Pham

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.05147 2023-11-03 cs.LG cs.AI 62%

Model-free Policy Learning with Reward Gradients

Qingfeng Lan, Samuele Tosatto, Homayoon Farrahi, A. Rupam Mahmood

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments AISTATS 2022 camera-ready (fixed a bug)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00267 2023-11-02 cs.LG cs.AI 62%

Rethinking Decision Transformer via Hierarchical Reinforcement Learning

Yi Ma, Chenjun Xiao, Hebin Liang, Jianye Hao

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.20663 2023-11-01 cs.LG cs.AI 62%

Offline RL with Observation Histories: Analyzing and Improving Sample Complexity

Joey Hong, Anca Dragan, Sergey Levine

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19927 2023-11-01 cs.LG cs.AI 62%

Model-Based Reparameterization Policy Gradient Methods: Theory and Practical Algorithms

Shenao Zhang, Boyi Liu, Zhaoran Wang, Tuo Zhao

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Published at NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14993 2023-10-30 cs.AI cs.LG 62%

Thinker: Learning to Plan and Act

Stephen Chung, Ivan Anokhin, David Krueger

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

Comments 38 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14884 2023-10-30 cs.LG cs.AI 62%

Learning to Modulate pre-trained Models in RL

Thomas Schmied, Markus Hofmarcher, Fabian Paischer, Razvan Pascanu, Sepp Hochreiter

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments 10 pages (+ references and appendix), Code: https://github.com/ml-jku/L2M

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.04407 2023-10-26 cs.LG cs.AI 62%

Dynamic Decision Frequency with Continuous Options

Amirmohammad Karimi, Jun Jin, Jun Luo, A. Rupam Mahmood, Martin Jagersand, Samuele Tosatto

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments Appears in the Proceedings of the 2023 International Conference on Intelligent Robots and Systems (IROS). Source code at https://github.com/amir-karimi96/continuous-time-continuous-option-policy-gradient.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13295 2023-10-23 cs.RO cs.AI 62%

PathRL: An End-to-End Path Generation Method for Collision Avoidance via Deep Reinforcement Learning

Wenhao Yu, Jie Peng, Quecheng Qiu, Hanyu Wang, Lu Zhang, Jianmin Ji

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.15228 2023-10-23 cs.RO cs.AI 62%

IIFL: Implicit Interactive Fleet Learning from Heterogeneous Human Supervisors

Gaurav Datta, Ryan Hoque, Anrui Gu, Eugen Solowjow, Ken Goldberg

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments CoRL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.13623 2023-10-20 cs.AI cs.CL cs.LG cs.SD eess.AS 62%

Reinforcement Learning and Bandits for Speech and Language Processing: Tutorial, Review and Outlook

Baihan Lin

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments To appear in Expert Systems with Applications. Accompanying INTERSPEECH 2022 Tutorial on the same topic. Including latest advancements in large language models (LLMs)

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.13137 2023-10-18 cs.RO cs.AI 62%

A Human-Centered Safe Robot Reinforcement Learning Framework with Interactive Behaviors

Shangding Gu, Alap Kshirsagar, Yali Du, Guang Chen, Jan Peters, Alois Knoll

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.03811 2023-10-17 cs.LG cs.AI 62%

Environment Transformer and Policy Optimization for Model-Based Offline Reinforcement Learning

Pengqin Wang, Meixin Zhu, Shaojie Shen

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments ICRA2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09997 2023-10-17 cs.AI cs.LG cs.SY eess.SY 62%

Forecaster: Towards Temporally Abstract Tree-Search Planning from Pixels

Thomas Jiralerspong, Flemming Kondrup, Doina Precup, Khimya Khetarpal

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏