arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4116 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4116 篇

2510.01083 2025-10-02 cs.LG 57%

Multi-Actor Multi-Critic Deep Deterministic Reinforcement Learning with a Novel Q-Ensemble Method

Andy Wu, Chun-Cheng Lin, Rung-Tzuo Liaw, Yuehua Huang, Chihjung Kuo, Chia Tong Weng

机构 * csie.fju.edu.tw(逢甲大学计算机科学系)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26137 2025-10-01 cs.LG 57%

Accelerating Transformers in Online RL

Daniil Zelezetsky, Alexey K. Kovalev, Aleksandr I. Panov

机构 * Cognitive AI Lab(认知人工智能实验室)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26082 2025-10-01 cs.RO 57%

Evolutionary Continuous Adaptive RL-Powered Co-Design for Humanoid Chin-Up Performance

Tianyi Jin, Melya Boukheddimi, Rohit Kumar, Gabriele Fadini, Frank Kirchner

机构 * Robotics Innovation Center, DFKI GmbH(DFKI机器人创新中心) Computational Robotics Lab, ETH Zurich(苏黎世联邦理工学院计算机器人实验室) AG Robotik University of Bremen(不莱梅大学机器人技术研究所) RWTH Aachen University(亚琛工业大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09308 2025-10-01 cs.LG 57%

Neural Multivariate Regression: Qualitative Insights from the Unconstrained Feature Model

George Andriopoulos, Soyuj Jung Basnet, Juan Guevara, Li Guo, Keith Ross

机构 * New York University Abu Dhabi(纽约大学阿布扎克分校) New York University Shanghai(纽约大学上海分校) New York University(纽约大学) MBZUAI(马斯喀特人工智能研究所)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 35 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19752 2025-09-30 cs.RO 57%

Beyond Human Demonstrations: Diffusion-Based Reinforcement Learning to Generate Data for VLA Training

Rushuai Yang, Hangxing Wei, Ran Zhang, Zhiyuan Feng, Xiaoyu Chen, Tong Li, Chuheng Zhang, Li Zhao, Jiang Bian, Xiu Su, Yi Chen

机构 * Hong Kong University of Science and Technology(香港科技大学) Microsoft Research Asia(微软亚洲研究院) Wuhan University(武汉大学) University of Chinese Academy of Sciences(中国科学院大学) Tsinghua University(清华大学) Big Data Institute, Central South University(中南大学大数据研究院)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23220 2025-09-30 cs.RO 57%

GLUE: Global-Local Unified Encoding for Imitation Learning via Key-Patch Tracking

Ye Chen, Zichen Zhou, Jianyu Dou, Te Cui, Yi Yang, Yufeng Yue

机构 * Beijing Institute of Technology(北京理工大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23219 2025-09-30 cs.LG 57%

WirelessMathLM: Teaching Mathematical Reasoning for LLMs in Wireless Communications with Reinforcement Learning

Xin Li, Mengbing Liu, Yiyang Zhu, Wenhe Zhang, Li Wei, Jiancheng An, Chau Yuen

机构 * Nanyang Technological University(南洋理工大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

Comments Project Homepage: https://lixin.ai/WirelessMathLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16757 2025-09-30 cs.RO 57%

HDMI: Learning Interactive Humanoid Whole-Body Control from Human Videos

Haoyang Weng, Yitang Li, Nikhil Sobanbabu, Zihan Wang, Zhengyi Luo, Tairan He, Deva Ramanan, Guanya Shi

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

Comments website: hdmi-humanoid.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20541 2025-09-26 cs.RO 57%

Selective Progress-Aware Querying for Human-in-the-Loop Reinforcement Learning

Anujith Muraleedharan, Anamika J H

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.RO

Comments Preprint. 8 pages, 3 figures, 1 table, 1 algorithm. CoRL 2025 style (preprint). Code/data to be released

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07848 2025-09-26 cs.AI 57%

Safe Explicable Policy Search

Akkamahadevi Hanni, Jonathan Montaño, Yu Zhang

机构 * School of Computing and Augmented Intelligence, Arizona State University(计算与增强智能学院,亚利桑那州立大学) School of Mathematical and Statistical Sciences, Arizona State University(数学与统计科学学院,亚利桑那州立大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14453 2025-09-22 cs.RO cs.MA cs.SY eess.SY 57%

Online Learning of Deceptive Policies under Intermittent Observation

Gokul Puthumanaillam, Ram Padmanabhan, Jose Fuentes, Nicole Cruz, Paulo Padrao, Ruben Hernandez, Hao Jiang, William Schafer, Leonardo Bobadilla, Melkior Ornik

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Providence College(普罗维登斯学院) Florida International University(佛罗里达国际大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03693 2025-09-22 cs.LG 57%

PAC Apprenticeship Learning with Bayesian Active Inverse Reinforcement Learning

Ondrej Bajgar, Dewi S. W. Gould, Jonathon Liu, Alessandro Abate, Konstantinos Gatsis, Michael A. Osborne

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments Presented at RLC 2025; published in RLJ 2025

Journal ref Reinforcement Learning Journal 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13200 2025-09-22 cs.RO 57%

StageACT: Stage-Conditioned Imitation for Robust Humanoid Door Opening

Moonyoung Lee, Dong Ki Kim, Jai Krishna Bandi, Max Smith, Aileen Liao, Ali-akbar Agha-mohammadi, Shayegan Omidshafiei

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11240 2025-09-16 cs.RO cs.SY eess.SY 57%

CORB-Planner: Corridor as Observations for RL Planning in High-Speed Flight

Yechen Zhang, Bin Gao, Gang Wang, Jian Sun, Zhuo Li

机构 * State Key Laboratory of Autonomous Intelligent Unmanned Systems, School of Automation, Beijing Institute of Technology(自主智能无人系统国家重点实验室,自动化学院,北京理工大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments 11 pages, 8 figures. Submitted to IEEE/ASME T-MECH. Code available at https://github.com/ChenzycBIT/CORB-planner

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09772 2025-09-15 cs.LG stat.AP 57%

Hybrid Adaptive Conformal Offline Reinforcement Learning for Fair Population Health Management

Sanjay Basu, Sadiq Y. Patel, Parth Sheth, Bhairavi Muralidharan, Namrata Elamaran, Aakriti Kinra, Rajaie Batniji

机构 * Waymark, San Francisco, CA, USA(Waymark) San Francisco General Hospital, University of California San Francisco, San Francisco, CA, USA(旧金山通用医院,加州大学旧金山分校) University of California San Francisco, San Francisco, CA, USA(加州大学旧金山分校) University of Pennsylvania, Philadelphia, PA, USA(宾夕法尼亚大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments 10 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08500 2025-09-11 cs.AI 57%

TCPO: Thought-Centric Preference Optimization for Effective Embodied Decision-making

Kechen Jiao, Zhirui Fang, Jiahao Liu, Bei Li, Qifan Wang, Xinyu Liu, Junhao Ruan, Zhongjian Qiao, Yifan Zhu, Yaxin Xu, Jingang Wang, Xiu Li

机构 * Tsinghua University(清华大学) Meituan(美团) Northeastern University(东北大学) Beijing University of Posts and Telecommunications(北京邮电大学) Meta AI Wuhan University(武汉大学)

专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00757 2025-09-09 cs.RO 57%

Collaborative motion planning for multi-manipulator systems through Reinforcement Learning and Dynamic Movement Primitives

Siddharth Singh, Tian Xu, Qing Chang

机构 * Department of Mechanical & Aerospace Engineering, University of Virginia(机械与航空航天工程系,弗吉尼亚大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments 7 pages, 7 figures, conference submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04737 2025-09-08 cs.RO 57%

Imitation Learning Based on Disentangled Representation Learning of Behavioral Characteristics

Ryoga Oishi, Sho Sakaino, Toshiaki Tsuji

机构 * Saitama University(埼玉大学) University of Tsukuba(筑波大学)

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.RO

Comments 16 pages, 5 figures, Accepted at CoRL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04259 2025-09-05 cs.LG 57%

RL's Razor: Why Online Reinforcement Learning Forgets Less

Idan Shenfeld, Jyothish Pari, Pulkit Agrawal

机构 * Improbable AI Lab, MIT(Improbable AI Lab 和 马萨诸塞理工学院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02164 2025-09-03 cs.CV 57%

Omnidirectional Spatial Modeling from Correlated Panoramas

Xinshen Zhang, Tongxi Fu, Xu Zheng

机构 * The Hong Kong Polytechnic University(香港理工大学) Zhejiang Sci-Tech University(浙江科技学院)

专题命中 模仿学习与强化学习 :embodied AI(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21501 2025-09-01 cs.RO 57%

Few-Shot Neuro-Symbolic Imitation Learning for Long-Horizon Planning and Acting

Pierrick Lorang, Hong Lu, Johannes Huemer, Patrik Zips, Matthias Scheutz

机构 * Tufts University, United States(美国塔夫茨大学) Austrian Institute of Technology, Austria(奥地利技术研究所) Human-Robot Interaction Lab(人机交互实验室)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments Accepted at CoRL 2025; to appear in PMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16942 2025-08-26 cs.CV 57%

HieroAction: Hierarchically Guided VLM for Fine-Grained Action Analysis

Junhao Wu, Xiuer Gu, Zhiying Li, Yeying Jin, Yunfeng Diao, Zhiyu Li, Zhenbo Song, Xiaomei Zhang, Zhaoxin Fan

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15013 2025-08-22 cs.AI q-bio.NC 57%

Goals and the Structure of Experience

Nadav Amir, Stas Tiomkin, Angela Langdon

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13434 2025-08-15 cs.RO 57%

Tactile Aware Dynamic Obstacle Avoidance in Crowded Environment with Deep Reinforcement Learning

Yung Chuen Ng, Qi Wen Shervina Lim, Chun Ye Tan, Zhen Hao Gan, Meng Yee Michael Chuah

机构 * Institute for Infocomm Research (I 2 R), A*STAR(信息通信研究所(I2R),A*STAR) Nanyang Technological University (NTU)(南洋理工大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08511 2025-08-14 cs.RO 57%

Vision-driven UAV River Following: Benchmarking with Safe Reinforcement Learning

Zihan Wang, Nina Mahmoudian

机构 * School of Mechanical Engineering, Purdue University(机械工程学院,普渡大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

Comments Accepted by conference IFAC CAMS 2024

Journal ref IFAC-PapersOnLine, 58(20): 421-427, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.09332 2025-08-14 cs.RO 57%

Synergistic Reinforcement and Imitation Learning for Vision-driven Autonomous Flight of UAV Along River

Zihan Wang, Jianwen Li, Nina Mahmoudian

机构 * School of Mechanical Engineering, Purdue University(机械工程学院,普渡大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

Comments Submitted to IROS2024

Journal ref 979-8-3503-7770-5/24/$31.00 \c{opyright}2024 IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15250 2025-08-13 cs.LG 57%

Multi-modal Policies with Physics-informed Representations in Complex Fluid Environments

Haodong Feng, Peiyan Hu, Yue Wang, Dixia Fan

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08029 2025-08-12 cs.RO cs.SY eess.SY 57%

Elastic Motion Policy: An Adaptive Dynamical System for Robust and Efficient One-Shot Imitation Learning

Tianyu Li, Sunan Sun, Shubhodeep Shiv Aditya, Nadia Figueroa

机构 * School of Engineering and Applied Science, University of Pennsylvania(工程与应用科学学院,宾夕法尼亚大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06804 2025-08-12 cs.RO 57%

D3P: Dynamic Denoising Diffusion Policy via Reinforcement Learning

Shu-Ang Yu, Feng Gao, Yi Wu, Chao Yu, Yu Wang

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06330 2025-08-11 cs.RO 57%

L2Calib: $SE(3)$-Manifold Reinforcement Learning for Robust Extrinsic Calibration with Degenerate Motion Resilience

Baorun Li, Chengrui Zhu, Siyi Du, Bingran Chen, Jie Ren, Wenfei Wang, Yong Liu, Jiajun Lv

机构 * Institute of Cyber-Systems and Control, Zhejiang University, China(浙江大学控制科学与工程学院) State Key Laboratory of Industrial Control Technology, Zhejiang University, China(浙江大学工业控制技术状态重点实验室) Zhejiang Guozi Robotics Technology Co., Ltd.(浙江国智机器人科技有限公司)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments IROS2025

详情

展开后加载摘要…

URL PDF HTML 收藏