arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4116 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4116 篇

2506.11723 2025-06-16 cs.RO 57%

Dynamic Collaborative Material Distribution System for Intelligent Robots In Smart Manufacturing

Ziren Xiao, Ruxin Xiao, Chang Liu, Xinheng Wang

机构 * School of Advanced Technology, Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学先进科技学院)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11285 2025-06-16 cs.MA cs.GT cs.LG 57%

Shapley Machine: A Game-Theoretic Framework for N-Agent Ad Hoc Teamwork

Jianhong Wang, Yang Li, Samuel Kaski, Jonathan Lawry

机构 * INFORMED-AI Hub University of Bristol, UK(INFORMED-AI Hub 英国布里斯托大学) Centre for AI Fundamentals University of Manchester, UK(人工智能基础研究中心 英国曼彻斯特大学) School of Engineering Mathematics and Technology University of Bristol, UK(工程数学与技术学院 英国布里斯托大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08751 2025-06-13 cs.LG 57%

Zero-Shot Offline Imitation Learning via Optimal Transport

Thomas Rupf, Marco Bagatella, Nico Gürtler, Jonas Frey, Georg Martius

机构 * ETH, Zürich, Switzerland(苏黎世联邦理工学院)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08639 2025-06-11 cs.RO cs.SY eess.SY 57%

Deep Reinforcement Learning-Based Motion Planning and PDE Control for Flexible Manipulators

Amir Hossein Barjini, Seyed Adel Alizadeh Kolagar, Sadeq Yaqubi, Jouni Mattila

机构 * Department of Engineering and Natural Sciences, Tampere University(工程与自然科学系,塔尔皮耶大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22942 2025-06-10 cs.CL cs.AI 57%

WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning

Yuchen Zhuang, Di Jin, Jiaao Chen, Wenqi Shi, Hanrui Wang, Chao Zhang

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10966 2025-06-09 cs.RO stat.ML 57%

Is Your Imitation Learning Policy Better than Mine? Policy Comparison with Near-Optimal Stopping

David Snyder, Asher James Hancock, Apurva Badithela, Emma Dixon, Patrick Miller, Rares Andrei Ambrus, Anirudha Majumdar, Masha Itkina, Haruki Nishimura

机构 * Toyota Research Institute (TRI)(丰田研究院) Princeton University(普林斯顿大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

Comments 14 + 5 pages, 10 figures, 4 tables. Accepted to RSS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11488 2025-06-09 cs.LG 57%

Informed POMDP: Leveraging Additional Information in Model-Based RL

Gaspard Lambrechts, Adrien Bolland, Damien Ernst

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.LG

Comments In Reinforcement Learning Conference, 2024. 10 pages, 22 pages total, 10 figures

Journal ref Reinforcement Learning Journal, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04821 2025-06-06 cs.LG 57%

LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning

Zhen Hao Wong, Jingwen Deng, Runming He, Zirong Chen, Qijie You, Hejun Dong, Hao Liang, Chengyu Shen, Bin Cui, Wentao Zhang

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04588 2025-06-05 cs.AI 57%

Zero-shot cross-modal transfer of Reinforcement Learning policies through a Global Workspace

Léopold Maytié, Benjamin Devillers, Alexandre Arnold, Rufin VanRullen

机构 * Airbus AI Research(空客人工智能研究)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

Journal ref Reinforcement Learning Journal, Vol. 3, 2024, pp. 1410-1426

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14622 2025-06-04 cs.RO 57%

Learning Autonomous Surgical Irrigation and Suction with the da Vinci Research Kit Using Reinforcement Learning

Yafei Ou, Mahdi Tavakoli

机构 * Department of Electrical and Computer Engineering, University of Alberta(电气与计算机工程系,阿尔伯塔大学) Department of Biomedical Engineering, University of Alberta(生物医学工程系,阿尔伯塔大学)

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.RO

Comments 15 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.13140 2025-06-04 cs.RO 57%

Learn With Imagination: Safe Set Guided State-wise Constrained Policy Optimization

Yifan Sun, Feihan Li, Weiye Zhao, Rui Chen, Tianhao Wei, Changliu Liu

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

Comments arXiv admin note: text overlap with arXiv:2306.12594

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00276 2025-06-03 cs.RO cs.CL 57%

RoboMoRe: LLM-based Robot Co-design via Joint Optimization of Morphology and Reward

Jiawei Fang, Yuxuan Sun, Chengtian Ma, Qiuyu Lu, Lining Yao

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

Comments 30 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08179 2025-06-02 cs.LG 57%

Feasibility-Aware Pessimistic Estimation: Toward Long-Horizon Safety in Offline RL

Zhikun Tao

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments arXiv admin comment: This version removed due to inaccurate authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22696 2025-05-30 cs.LG 57%

When Does Neuroevolution Outcompete Reinforcement Learning in Transfer Learning Tasks?

Eleni Nisioti, Joachim Winther Pedersen, Erwan Plantec, Milton L. Montero, Sebastian Risi

机构 * The Thørväld Group(索尔瓦尔德集团) Inria Paris-Rocquencourt(巴黎-鲁克肯堡国家信息与自动化研究所) Rajiv Gandhi University Doimukh(拉贾·甘地大学多伊穆克) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒姆研究实验室) The Kumquat Consortium(昆quat联盟)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20889 2025-05-28 cs.AI 57%

Reinforcement Learning-based Sequential Route Recommendation for System-Optimal Traffic Assignment

Leizhen Wang, Peibo Duan, Cheng Lyu, Zhenliang Ma

机构 * Department of Data Science and Artificial Intelligence, Monash University(墨尔本大学数据科学与人工智能系) Chair of Transportation Systems Engineering, Technical University of Munich(慕尼黑技术大学交通系统工程教授职位) Department of Civil and Architectural Engineering, KTH Royal Institute of Technology(瑞典皇家理工学院土木与建筑工程系)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02434 2025-05-27 cs.LG 57%

mPOLICE: Provable Enforcement of Multi-Region Affine Constraints in Deep Neural Networks

Mohammadmehdi Ataei, Hyunmin Cheong, Adrian Butscher

机构 * Autodesk Research(Autodesk研究)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17218 2025-05-26 cs.AI 57%

Effective Reinforcement Learning for Reasoning in Language Models

Lianghuan Huang, Shuo Li, Sagnik Anupam, Insup Lee, Osbert Bastani

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01309 2025-05-26 cs.NE cs.AI 57%

REvolve: Reward Evolution with Large Language Models using Human Feedback

Rishi Hazra, Alkis Sygkounas, Andreas Persson, Amy Loutfi, Pedro Zuidberg Dos Martires

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI

Comments Published in ICLR 2025. Project page: https://rishihazra.github.io/REvolve

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13609 2025-05-26 cs.LG q-fin.CP quant-ph 57%

Tackling Decision Processes with Non-Cumulative Objectives using Reinforcement Learning

Maximilian Nägele, Jan Olle, Thomas Fösel, Remmy Zen, Florian Marquardt

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15211 2025-05-22 cs.RO 57%

GCNT: Graph-Based Transformer Policies for Morphology-Agnostic Reinforcement Learning

Yingbo Luo, Meibao Yao, Xueming Xiao

机构 * Jilin University(吉林大学) Changchun University of Science and Technology(长春理工大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12648 2025-05-20 cs.RO 57%

SafeMove-RL: A Certifiable Reinforcement Learning Framework for Dynamic Motion Constraints in Trajectory Planning

Tengfei Liu, Haoyang Zhong, Jiazheng Hu, Tan Zhang

机构 * Sino-German College of Intelligent Manufacturing, Shenzhen Technology University(深圳技术大学中德智能制造学院) Faculty of Science and Technology, University of Macau(澳门大学科技学院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11858 2025-05-20 cs.RO 57%

Integrating Model-based Control and RL for Sim2Real Transfer of Tight Insertion Policies

Isidoros Marougkas, Dhruv Metha Ramesh, Joe H. Doerr, Edgar Granados, Aravind Sivaramakrishnan, Abdeslam Boularias, Kostas E. Bekris

机构 * Dept. of Computer Science, Rutgers University, NJ, USA(计算机科学系,新泽西州立大学) Amazon.com Inc(亚马逊公司) Rutgers University(新泽西州立大学) Amazon Scholar(亚马逊学者)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09979 2025-05-16 cs.RO 57%

Learning Diverse Natural Behaviors for Enhancing the Agility of Quadrupedal Robots

Huiqiao Fu, Haoyu Dong, Wentao Xu, Zhehao Zhou, Guizhou Deng, Kaiqiang Tang, Daoyi Dong, Chunlin Chen

机构 * Department of Control Science and Intelligent Engineering(控制科学与智能工程系) School of Management and Engineering(管理与工程学院) Australian Artificial Intelligence Institute(澳大利亚人工智能研究所)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09192 2025-05-16 cs.LG 57%

Towards More Efficient, Robust, Instance-adaptive, and Generalizable Sequential Decision making

Zhiyong Wang

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments Ph.D. Thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08238 2025-05-14 cs.RO 57%

Motion Control of High-Dimensional Musculoskeletal Systems with Hierarchical Model-Based Planning

Yunyue Wei, Shanning Zhuang, Vincent Zhuang, Yanan Sui

机构 * Tsinghua University(清华大学) Google DeepMind(谷歌DeepMind)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments Accepted by ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02216 2025-05-13 cs.AI 57%

LLM-Guided Probabilistic Program Induction for POMDP Model Estimation

Aidan Curtis, Hao Tang, Thiago Veloso, Kevin Ellis, Joshua Tenenbaum, Tomás Lozano-Pérez, Leslie Pack Kaelbling

机构 * MIT(麻省理工学院) Cornell University(康奈尔大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13163 2025-05-13 cs.IR cs.AI 57%

ROLeR: Effective Reward Shaping in Offline Reinforcement Learning for Recommender Systems

Yi Zhang, Ruihong Qiu, Jiajun Liu, Sen Wang

机构 * The University of Queensland(昆士兰大学) CSIRO DATA61

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI

Comments CIKM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05548 2025-05-12 cs.RO cs.SY eess.SY 57%

Barrier Function Overrides For Non-Convex Fixed Wing Flight Control and Self-Driving Cars

Eric Squires, Phillip Odom, Zsolt Kira

机构 * Georgia Tech Research Institute(佐治亚理工学院研究 institute) College of Computing at the Georgia Institute of Technology(佐治亚理工学院计算机学院)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00671 2025-05-02 cs.RO cs.SY eess.SY 57%

Multi-Constraint Safe Reinforcement Learning via Closed-form Solution for Log-Sum-Exp Approximation of Control Barrier Functions

Chenggang Wang, Xinyi Wang, Yutong Dong, Lei Song, Xinping Guan

机构 * Shanghai Jiao Tong University(上海交通大学) University of Michigan(密歇根大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21433 2025-05-01 cs.AI 57%

NGENT: Next-Generation AI Agents Must Integrate Multi-Domain Abilities to Achieve Artificial General Intelligence

Zhicong Li, Hangyu Mao, Jiangjin Yin, Mingzhe Xing, Zhiwei Xu, Yuanxing Zhang, Yang Xiao

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏