arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

共收录 1124 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 模型式强化学习 1124 篇

2310.04159 2024-04-16 cs.LG 56%

Amortized Network Intervention to Steer the Excitatory Point Processes

Zitao Song, Wendi Ren, Shuang Li

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14110 2024-03-22 cs.LG cs.AI 56%

Heuristic Algorithm-based Action Masking Reinforcement Learning (HAAM-RL) with Ensemble Inference Method

Kyuwon Choi, Cheolkyun Rho, Taeyoun Kim, Daewoo Choi

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments 7 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00229 2024-03-19 cs.AI cs.LG 56%

Consciousness-Inspired Spatio-Temporal Abstractions for Better Generalization in Reinforcement Learning

Mingde Zhao, Safa Alver, Harm van Seijen, Romain Laroche, Doina Precup, Yoshua Bengio

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments ICLR 2024 Camera-Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.17366 2024-03-04 cs.LG cs.AI 56%

$λ$-models: Effective Decision-Aware Reinforcement Learning with Latent Models

Claas A Voelcker, Arash Ahmadian, Romina Abachi, Igor Gilitschenski, Amir-massoud Farahmand

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13282 2024-01-25 cs.LG cs.AI 56%

RefreshNet: Learning Multiscale Dynamics through Hierarchical Refreshing

Junaid Farooq, Danish Rafiq, Pantelis R. Vlachas, Mohammad Abid Bazaz

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07369 2024-01-17 cs.LG cs.RO 56%

CoVO-MPC: Theoretical Analysis of Sampling-based MPC and Optimal Covariance Design

Zeji Yi, Chaoyi Pan, Guanqi He, Guannan Qu, Guanya Shi

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG、cs.RO

Comments 32 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.11048 2023-12-29 cs.LG cs.AI 56%

Adversarial Model for Offline Reinforcement Learning

Mohak Bhardwaj, Tengyang Xie, Byron Boots, Nan Jiang, Ching-An Cheng

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments Accepted at the Neural Information Processing Systems (NeurIPS), 2023. Mohak Bhardwaj and Tengyang Xie contributed equally to this work. arXiv admin note: text overlap with arXiv:2211.04538

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.10426 2023-11-30 cs.LG 56%

Discovering Predictable Latent Factors for Time Series Forecasting

Jingyi Hou, Zhen Dong, Jiayu Zhou, Zhijie Liu

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.12671 2023-10-25 cs.LG cs.AI 56%

How to Fine-tune the Model: Unified Model Shift and Model Bias Policy Optimization

Hai Zhang, Hang Yu, Junqiao Zhao, Di Zhang, Chang Huang, Hongtu Zhou, Xiao Zhang, Chen Ye

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.14182 2023-10-19 cs.LG cs.AI 56%

Taylor TD-learning

Michele Garibbo, Maxime Robeyns, Laurence Aitchison

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments Published as a conference paper at NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09495 2023-10-17 cs.LG cs.CV stat.ML 56%

Learning In-between Imagery Dynamics via Physical Latent Spaces

Jihun Han, Yoonsang Lee, Anne Gelb

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG、cs.CV

Comments 26 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16979 2023-09-21 cs.AI cs.LG 56%

Adaptive PD Control using Deep Reinforcement Learning for Local-Remote Teleoperation with Stochastic Time Delays

Luc McCutcheon, Saber Fallah

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments 7 pages + 1 references, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.07461 2023-08-10 cs.LG cs.GT cs.MA math.OC stat.ML 56%

Model-Based Multi-Agent RL in Zero-Sum Markov Games with Near-Optimal Sample Complexity

Kaiqing Zhang, Sham M. Kakade, Tamer Başar, Lin F. Yang

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG、cs.MA

Comments Updated version accepted to Journal of Machine Learning Research (JMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14085 2023-07-27 cs.LG cs.AI math.ST stat.ML stat.TH 56%

Actions Speak What You Want: Provably Sample-Efficient Reinforcement Learning of the Quantal Stackelberg Equilibrium from Strategic Feedbacks

Siyu Chen, Mengdi Wang, Zhuoran Yang

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments 129 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06630 2023-07-14 cs.CV cs.AI 56%

Image Transformation Sequence Retrieval with General Reinforcement Learning

Enrique Mas-Candela, Antonio Ríos-Vila, Jorge Calvo-Zaragoza

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.04165 2023-07-04 cs.LG cs.CE nlin.CD stat.ML 56%

Neural Extended Kalman Filters for Learning and Predicting Dynamics of Structural Systems

Wei Liu, Zhilu Lai, Kiran Bacsa, Eleni Chatzi

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG;dynamics model(abstract)

Comments Accepted for publication in Structural Health Monitoring

Journal ref Structural Health Monitoring, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.03771 2023-07-03 q-bio.NC cs.LG 56%

Expressive architectures enhance interpretability of dynamics-based neural population models

Andrew R. Sedler, Christopher Versteeg, Chethan Pandarinath

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG;dynamics model(abstract)

Comments Accepted to Neurons, Behavior, Data analysis and Theory (14 pages, 3 figures). Added missing funding info and updated supplement sections 11.1 and 11.2. Updated acknowledgments

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.01549 2023-06-06 stat.ML cs.LG 56%

Streaming Variational Monte Carlo

Yuan Zhao, Josue Nassar, Ian Jordan, Mónica Bugallo, Il Memming Park

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.12016 2023-05-26 cs.AI cs.LG 56%

Mastering the Unsupervised Reinforcement Learning Benchmark from Pixels

Sai Rajeswar, Pietro Mazzaglia, Tim Verbelen, Alexandre Piché, Bart Dhoedt, Aaron Courville, Alexandre Lacoste

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICML 2023 (oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.04050 2023-05-10 stat.ML cs.LG cs.MA 56%

Efficient Model-Based Multi-Agent Mean-Field Reinforcement Learning

Barna Pásztor, Ilija Bogunovic, Andreas Krause

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG、cs.MA

Journal ref Pásztor, B., Krause, A., & Bogunovic, I. (2023). Efficient Model-Based Multi-Agent Mean-Field Reinforcement Learning. Transactions on Machine Learning Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.12526 2023-03-08 cs.LG cs.AI stat.ML 56%

Model-Based Uncertainty in Value Functions

Carlos E. Luis, Alessandro G. Bottero, Julia Vinogradska, Felix Berkenkamp, Jan Peters

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments AISTATS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.10311 2023-02-22 cs.LG cs.AI 56%

Understanding the effect of varying amounts of replay per step

Animesh Kumar Paul, Videh Raj Nema

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments 10 Pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.14576 2023-02-22 cs.CL cs.AI cs.LG 56%

Using cognitive psychology to understand GPT-3

Marcel Binz, Eric Schulz

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.09846 2023-02-21 cs.RO 56%

Neural Optimal Control using Learned System Dynamics

Selim Engin, Volkan Isler

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.RO;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.03958 2023-02-09 cs.AI cs.LG 56%

Non-zero-sum Game Control for Multi-vehicle Driving via Reinforcement Learning

Xujie Song, Zexi Lin

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.03933 2023-01-11 astro-ph.IM cs.LG 56%

Hint assisted reinforcement learning: an application in radio astronomy

Sarod Yatawatta

专题命中 模型式强化学习 :model based reinforcement learning(abstract);分类 cs.LG;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.08235 2022-12-19 cs.LG cs.RO 56%

A Simple Decentralized Cross-Entropy Method

Zichen Zhang, Jun Jin, Martin Jagersand, Jun Luo, Dale Schuurmans

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG、cs.RO

Comments NeurIPS 2022. The last two authors advised equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.14827 2022-11-29 cs.LG cs.AI stat.ML 56%

Domain Generalization for Robust Model-Based Offline Reinforcement Learning

Alan Clark, Shoaib Ahmed Siddiqui, Robert Kirk, Usman Anwar, Stephen Chung, David Krueger

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments Accepted to the NeurIPS 2022 Workshops on Distribution Shifts and Offline Reinforcement Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.12115 2022-11-29 cs.LG cs.RO 56%

Model-Based Policy Search Using Monte Carlo Gradient Estimation with Real Systems Application

Fabio Amadio, Alberto Dalla Libera, Riccardo Antonello, Daniel Nikovski, Ruggero Carli, Diego Romeres

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG、cs.RO

Comments Accepted in IEEE Transactions on Robotics. MC-PILCO code is publicly available at https://www.merl.com/research/license/MC-PILCO

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.11758 2022-11-23 cs.LG cs.AI 56%

A Graph Regularized Point Process Model For Event Propagation Sequence

Siqiao Xue, Xiaoming Shi, Hongyan Hao, Lintao Ma, Shiyu Wang, Shijun Wang, James Zhang

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.AI、cs.LG

Comments IJCNN 2021

Journal ref 2021 International Joint Conference on Neural Networks (IJCNN) (pp. 1-7). IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏