arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4116 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4116 篇

2502.12486 2025-05-29 cs.CL 50%

EPO: Explicit Policy Optimization for Strategic Reasoning in LLMs via Reinforcement Learning

Xiaoqian Liu, Ke Wang, Yongbin Li, Yuchuan Wu, Wentao Ma, Aobo Kong, Fei Huang, Jianbin Jiao, Junge Zhang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Tongyi Lab(通义实验室) The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(复杂系统认知与决策智能重点实验室,中国科学院自动化研究所)

专题命中 模仿学习与强化学习 :navigation(abstract)

Comments ACL2025 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07257 2025-05-13 cs.IR 50%

DARLR: Dual-Agent Offline Reinforcement Learning for Recommender Systems with Dynamic Reward

Yi Zhang, Ruihong Qiu, Xuwei Xu, Jiajun Liu, Sen Wang

专题命中 模仿学习与强化学习 :world model(abstract)

Comments SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23290 2025-04-01 cs.NI 50%

Efficient Twin Migration in Vehicular Metaverses: Multi-Agent Split Deep Reinforcement Learning with Spatio-Temporal Trajectory Generation

Junlong Chen, Jiawen Kang, Minrui Xu, Fan Wu, Hongliang Zhang, Huawei Huang, Dusit Niyato, Shiwen Mao

专题命中 模仿学习与强化学习 :navigation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10395 2025-03-14 physics.ins-det 50%

Optical stabilization for laser communication satellite systems through proportional-integral-derivative (PID) control and reinforcement learning approach

A. Reutov, S. Vorobey, A. Katanskiy, V. Balakirev, R. Bakhshaliev, K. Barbyshev, V. Merzlinkin, V. Tekaev

专题命中 模仿学习与强化学习 :navigation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00385 2025-03-04 eess.SY cs.SY 50%

Model-Agnostic Meta-Policy Optimization via Zeroth-Order Estimation: A Linear Quadratic Regulator Perspective

Yunian Pan, Tao Li, Quanyan Zhu

专题命中 模仿学习与强化学习 :robotics(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14995 2025-02-24 eess.IV 50%

Reinforcement Learning for Ultrasound Image Analysis A Comprehensive Review of Advances and Applications

Maha Ezzelarab, Midhila Madhusoodanan, Shrimanti Ghosh, Geetika Vadali, Jacob Jaremko, Abhilash Hareendranathan

专题命中 模仿学习与强化学习 :navigation(abstract)

Comments 36 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07112 2025-02-12 eess.SP 50%

Smell of Source: Learning-Based Odor Source Localization with Molecular Communication

Ayse Sila Okcu, Ozgur B. Akan

专题命中 模仿学习与强化学习 :robotics(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10990 2025-01-22 cs.DL cs.SI physics.soc-ph 50%

Societal citations undermine the function of the science reward system

Xiaokai Li, An Zeng, Ying Fan

专题命中 模仿学习与强化学习 :manipulation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19639 2025-01-19 cs.MA 50%

RMIO: A Model-Based MARL Framework for Scenarios with Observation Loss in Some Agents

Zifeng Shi, Meiqin Liu, Senlin Zhang, Ronghao Zheng, Shanling Dong

专题命中 模仿学习与强化学习 :world model(abstract)

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16985 2024-12-11 quant-ph 50%

Model-aware reinforcement learning for high-performance Bayesian experimental design in quantum metrology

Federico Belliardo, Fabio Zoratti, Florian Marquardt, Vittorio Giovannetti

专题命中 模仿学习与强化学习 :manipulation(abstract)

Comments 45 pages, 10 figures

Journal ref Quantum 8, 1555 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03501 2024-11-07 cs.MS cs.NA cs.SY eess.SY math.NA 50%

The Python LevelSet Toolbox (LevelSetPy)

Lekan Molu

专题命中 模仿学习与强化学习 :robotics(abstract)

Journal ref The 63rd IEEE Conference on Decision and Control, Milan, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01060 2024-09-04 cs.CE 50%

Multiagent Reinforcement Learning Enhanced Decision-making of Crew Agents During Floor Construction Process

Bin Yang, Boda Liu, Yilong Han, Xin Meng, Yifan Wang, Hansi Yang, Jianzhuang Xia

专题命中 模仿学习与强化学习 :robotics(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07346 2024-08-15 cond-mat.soft physics.bio-ph 50%

Enabling microrobotic chemotaxis via reset-free hierarchical reinforcement learning

Tongzhao Xiong, Zhaorong Liu, Chong Jin Ong, Lailai Zhu

专题命中 模仿学习与强化学习 :navigation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02938 2024-08-07 cs.DC 50%

Reinforcement Learning based Workflow Scheduling in Cloud and Edge Computing Environments: A Taxonomy, Review and Future Directions

Amanda Jayanetti, Saman Halgamuge, Rajkumar Buyya

专题命中 模仿学习与强化学习 :robotics(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16404 2024-07-24 eess.SY cs.SY 50%

Evaluating Uncertainties in Electricity Markets via Machine Learning and Quantum Computing

Shuyang Zhu, Ziqing Zhu, Linghua Zhu, Yujian Ye, Siqi Bu, Sasa Z. Djokic

专题命中 模仿学习与强化学习 :manipulation(abstract)

Comments 3 pages, 3 figures, plan for submitting to IEEE Power Engineering Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12872 2024-06-18 cs.GT 50%

Byzantine Robust Cooperative Multi-Agent Reinforcement Learning as a Bayesian Game

Simin Li, Jun Guo, Jingqiao Xiu, Ruixiao Xu, Xin Yu, Jiakai Wang, Aishan Liu, Yaodong Yang, Xianglong Liu

专题命中 模仿学习与强化学习 :manipulation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10539 2024-05-07 cs.NE 50%

Quality-Diversity Algorithms Can Provably Be Helpful for Optimization

Chao Qian, Ke Xue, Ren-Jian Wang

专题命中 模仿学习与强化学习 :robotics(abstract)

Comments The conference version of this paper has appeared at IJCAI'24. This version contains all the proof details

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13649 2024-03-21 q-bio.NC cs.NE nlin.AO 50%

Network bottlenecks and task structure control the evolution of interpretable learning rules in a foraging agent

Emmanouil Giannakakis, Sina Khajehabdollahi, Anna Levina

专题命中 模仿学习与强化学习 :embodied agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10621 2024-03-19 eess.SY cs.SY 50%

Lyapunov Neural Network with Region of Attraction Search

Zili Wang, Sean B. Andersson, Roberto Tron

专题命中 模仿学习与强化学习 :robotic(abstract)

Comments The paper has been accepted by 2024 American Control Conference (ACC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.13937 2024-01-17 cs.SE 50%

A Comparative Study on Reward Models for UI Adaptation with Reinforcement Learning

Daniel Gaspar-Figueiredo, Silvia Abrahão, Marta Fernández-Diego, Emilio Insfran

专题命中 模仿学习与强化学习 :manipulation(abstract)

Comments 6 pages + 1 refs. 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.13232 2023-12-21 cs.GT 50%

Learning Best Response Policies in Dynamic Auctions via Deep Reinforcement Learning

Vinzenz Thoma, Michael Curry, Niao He, Sven Seuken

专题命中 模仿学习与强化学习 :manipulation(abstract)

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17519 2023-12-18 cond-mat.stat-mech physics.comp-ph 50%

Reinforcement Learning with thermal fluctuations at the nano-scale

Francesco Boccardo, Olivier Pierre-Louis

专题命中 模仿学习与强化学习 :navigation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07216 2023-12-13 cs.SE 50%

Learning from Interaction: User Interface Adaptation using Reinforcement Learning

Daniel Gaspar-Figueiredo

专题命中 模仿学习与强化学习 :navigation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14940 2023-10-24 eess.SY cs.SY 50%

Comparison of path following in ships using modern and traditional controllers

Sanjeev Kumar Ramkumar Sudha, Md Shadab Alam, Bindusara Reddy, Abhilash Sharma Somayajula

专题命中 模仿学习与强化学习 :navigation(abstract)

Comments Proceedings of the Sixth International Conference in Ocean Engineering (ICOE2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06246 2023-10-11 eess.IV 50%

Compression Ratio Learning and Semantic Communications for Video Imaging

Bowen Zhang, Zhijin Qin, Geoffrey Ye Li

专题命中 模仿学习与强化学习 :robotic(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.12792 2023-10-06 eess.IV 50%

Deep Homography Prediction for Endoscopic Camera Motion Imitation Learning

Martin Huber, Sebastien Ourselin, Christos Bergeles, Tom Vercauteren

专题命中 模仿学习与强化学习 :robotic(abstract)

Comments Early accepted at MICCAI 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.04431 2023-09-26 cs.NE 50%

A Spiking Neural Network Structure Implementing Reinforcement Learning

Mikhail Kiselev

专题命中 模仿学习与强化学习 :robotics(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.06544 2023-08-16 cs.MA 50%

Herd's Eye View: Improving Game AI Agent Learning with Collaborative Perception

Andrew Nash, Andrew Vardy, David Churchill

专题命中 模仿学习与强化学习 :robotics(abstract)

Comments AIIDE 2023 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.15530 2023-07-31 cs.MA 50%

Learning to Collaborate by Grouping: a Consensus-oriented Strategy for Multi-agent Reinforcement Learning

Jingqing Ruan, Xiaotian Hao, Dong Li, Hangyu Mao

专题命中 模仿学习与强化学习 :navigation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.06082 2023-07-13 cs.MA 50%

Autotelic Reinforcement Learning in Multi-Agent Environments

Eleni Nisioti, Elías Masquil, Gautier Hamon, and Clément Moulin-Frier

专题命中 模仿学习与强化学习 :navigation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏