arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

共收录 1124 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 模型式强化学习 1124 篇

2410.10253 2025-03-10 cs.LG cs.AI cs.NE 56%

Feedback Favors the Generalization of Neural ODEs

Jindou Jia, Zihan Yang, Meng Wang, Kexin Guo, Jianfei Yang, Xiang Yu, Lei Guo

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.AI、cs.LG

Comments 27 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09781 2025-03-06 cs.CV 56%

VideoWorld: Exploring Knowledge Learning from Unlabeled Videos

Zhongwei Ren, Yunchao Wei, Xun Guo, Yao Zhao, Bingyi Kang, Jiashi Feng, Xiaojie Jin

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.CV;dynamics model(abstract)

Comments Code and models are released at: https://maverickren.github.io/VideoWorld.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01544 2025-03-03 cs.LG cs.AI cs.SY eess.SY 56%

KEEC: Koopman Embedded Equivariant Control

Xiaoyuan Cheng, Yiming Yang, Xiaohang Tang, Wei Jiang, Yukun Hu

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10400 2025-02-25 cs.CL cs.AI cs.LG 56%

Reinforcement Learning Enhanced LLMs: A Survey

Shuhe Wang, Shengyu Zhang, Jie Zhang, Runyi Hu, Xiaoya Li, Tianwei Zhang, Jiwei Li, Fei Wu, Guoyin Wang, Eduard Hovy

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12182 2025-02-19 physics.plasm-ph cs.AI cs.LG 56%

Towards Transparent and Accurate Plasma State Monitoring at JET

Andrin Bürli, Alessandro Pau, Thomas Koller, Olivier Sauter, JET Contributors

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03550 2025-02-07 cs.LG cs.RO 56%

TD-M(PC)$^2$: Improving Temporal Difference MPC Through Policy Constraint

Haotian Lin, Pengcheng Wang, Jeff Schneider, Guanya Shi

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG、cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12001 2025-02-04 cs.LG cs.AI 56%

Scrutinize What We Ignore: Reining In Task Representation Shift Of Context-Based Offline Meta Reinforcement Learning

Hai Zhang, Boyuan Zheng, Tianying Ji, Jinhang Liu, Anqi Guo, Junqiao Zhao, Lanqing Li

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments Accept at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16142 2025-01-28 cs.LG cs.AI 56%

Towards General-Purpose Model-Free Reinforcement Learning

Scott Fujimoto, Pierluca D'Oro, Amy Zhang, Yuandong Tian, Michael Rabbat

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15928 2025-01-28 cs.NI cs.AI cs.LG 56%

Generative AI for Lyapunov Optimization Theory in UAV-based Low-Altitude Economy Networking

Zhang Liu, Dusit Niyato, Jiacheng Wang, Geng Sun, Lianfen Huang, Zhibin Gao, Xianbin Wang

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 5 figures, magazine paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06328 2025-01-22 cs.LG 56%

Distributional Successor Features Enable Zero-Shot Policy Optimization

Chuning Zhu, Xinqi Wang, Tyler Han, Simon S. Du, Abhishek Gupta

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.LG;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02774 2025-01-07 cs.LG 56%

Learn A Flexible Exploration Model for Parameterized Action Markov Decision Processes

Zijian Wang, Bin Wang, Mingwen Shao, Hongbo Dou, Boxiang Tao

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.LG;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20537 2024-12-31 cs.LG 56%

Diminishing Return of Value Expansion Methods

Daniel Palenicek, Michael Lutter, João Carvalho, Daniel Dennert, Faran Ahmad, Jan Peters

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG;dynamics model(abstract)

Comments arXiv admin note: substantial text overlap with arXiv:2303.03955

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19194 2024-12-30 cs.LG cs.AI 56%

Provably Efficient Exploration in Reward Machines with Low Regret

Hippolyte Bourel, Anders Jonsson, Odalric-Ambrym Maillard, Chenxiao Ma, Mohammad Sadegh Talebi

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments 35 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1901.07905 2024-12-20 eess.SY cs.SY 56%

Reinforcement Learning Ship Autopilot: Sample efficient and Model Predictive Control-based Approach

Yunduan Cui, Shigeki Osaki, Takamitsu Matsubara

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);dynamics model(abstract);simulation model(abstract)

Comments The 2019 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2019)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17248 2024-12-10 cs.LG cs.AI cs.CC cs.DS stat.ML 56%

Rethinking Model-based, Policy-based, and Value-based Reinforcement Learning via the Lens of Representation Complexity

Guhao Feng, Han Zhong

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2024; this updated version includes additional theoretical findings and experimental results

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13846 2024-12-04 cs.LG cs.AI cs.CL 56%

Filtered Direct Preference Optimization

Tetsuro Morimura, Mitsuki Sakamoto, Yuu Jinnai, Kenshi Abe, Kaito Ariu

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11848 2024-12-03 stat.ML cs.AI cs.LG cs.NE physics.ao-ph q-bio.NC 56%

Alternators For Sequence Modeling

Mohammad Reza Rezaei, Adji Bousso Dieng

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.AI、cs.LG

Comments A new versatile family of sequence models that can be used for both generative modeling and supervised learning. The codebase will be made available upon publication. This paper is dedicated to Thomas Sankara

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19125 2024-12-02 cs.LG 56%

Advancing Generalization in PINNs through Latent-Space Representations

Honghui Wang, Yifan Pu, Shiji Song, Gao Huang

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12746 2024-11-21 q-fin.CP cs.AI cs.LG 56%

A Review of Reinforcement Learning in Financial Applications

Yahui Bai, Yuhe Gao, Runzhe Wan, Sheng Zhang, Rui Song

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00588 2024-11-04 cs.LG cs.AI 56%

$α$-TCVAE: On the relationship between Disentanglement and Diversity

Cristian Meo, Louis Mahon, Anirudh Goyal, Justin Dauwels

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07963 2024-11-01 cs.AI cs.LG 56%

SPO: Sequential Monte Carlo Policy Optimisation

Matthew V Macfarlane, Edan Toledo, Donal Byrne, Paul Duckworth, Alexandre Laterre

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments Accepted to NeurIPS 2024. 34 pages, 3 main figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16862 2024-10-30 stat.ML cs.LG 56%

Probabilistic Decomposed Linear Dynamical Systems for Robust Discovery of Latent Neural Dynamics

Yenho Chen, Noga Mudrik, Kyle A. Johnsen, Sankaraleengam Alagapan, Adam S. Charles, Christopher J. Rozell

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG;dynamics model(abstract)

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00840 2024-10-15 cs.LG cs.AI 56%

What model does MuZero learn?

Jinke He, Thomas M. Moerland, Joery A. de Vries, Frans A. Oliehoek

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments ECAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01968 2024-10-04 cs.RO 56%

Bi-Level Motion Imitation for Humanoid Robots

Wenshuai Zhao, Yi Zhao, Joni Pajarinen, Michael Muehlebach

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.RO;dynamics model(abstract)

Comments CoRL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04386 2024-09-18 cs.LG cs.AI 56%

Model-Based Epistemic Variance of Values for Risk-Aware Policy Optimization

Carlos E. Luis, Alessandro G. Bottero, Julia Vinogradska, Felix Berkenkamp, Jan Peters

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments arXiv admin note: substantial text overlap with arXiv:2302.12526

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04899 2024-07-22 cs.CV cs.AI 56%

Towards Scene Graph Anticipation

Rohith Peddi, Saksham Singh, Saurabh, Parag Singla, Vibhav Gogate

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.AI、cs.CV

Comments ECCV 2024, Code: https://github.com/rohithpeddi/SceneSayer

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17784 2024-06-05 cs.LG cs.AI 56%

Adaptive Horizon Actor-Critic for Policy Learning in Contact-Rich Differentiable Simulation

Ignat Georgiev, Krishnan Srinivasan, Jie Xu, Eric Heiden, Animesh Garg

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments Website https://adaptive-horizon-actor-critic.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18520 2024-05-30 cs.LG cs.AI 56%

Offline-Boosted Actor-Critic: Adaptively Blending Optimal Historical Behaviors in Deep Off-Policy RL

Yu Luo, Tianying Ji, Fuchun Sun, Jianwei Zhang, Huazhe Xu, Xianyuan Zhan

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08530 2024-05-27 cs.LG cs.AI stat.ML 56%

A Distributional Analogue to the Successor Representation

Harley Wiltzer, Jesse Farebrother, Arthur Gretton, Yunhao Tang, André Barreto, Will Dabney, Marc G. Bellemare, Mark Rowland

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments Accepted to ICML 2024. First two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00085 2024-05-21 cs.LG cs.AI 56%

Scheduled Curiosity-Deep Dyna-Q: Efficient Exploration for Dialog Policy Learning

Xuecheng Niu, Akinori Ito, Takashi Nose

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG

Comments Accepted to IEEE Access

Journal ref IEEE Access, vol. 12, pp. 46940-46952, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏