arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

共收录 1124 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 模型式强化学习 1124 篇

1811.07350 2018-11-20 cs.LG stat.ML 50%

Policy Optimization with Model-based Explorations

Feiyang Pan, Qingpeng Cai, An-Xiang Zeng, Chun-Xiang Pan, Qing Da, Hualin He, Qing He, Pingzhong Tang

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG

Comments Accepted at AAAI-19

详情

展开后加载摘要…

URL PDF HTML 收藏
1811.06272 2018-11-16 cs.LG stat.ML 50%

Woulda, Coulda, Shoulda: Counterfactually-Guided Policy Search

Lars Buesing, Theophane Weber, Yori Zwols, Sebastien Racaniere, Arthur Guez, Jean-Baptiste Lespiau, Nicolas Heess

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1804.10318 2018-11-05 cs.LG stat.ML 50%

Efficiently Learning Nonstationary Gaussian Processes for Real World Impact

Sahil Garg

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG

Comments Draft is not suitable for public view at present. It requires significant additions of experiment results

详情

展开后加载摘要…

URL PDF HTML 收藏
1804.06021 2018-10-09 cs.LG math.OC stat.ML 50%

Model-Free Linear Quadratic Control via Reduction to Expert Prediction

Yasin Abbasi-Yadkori, Nevena Lazic, Csaba Szepesvari

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.03931 2018-08-02 cs.LG stat.ML 50%

A Hierarchical Bayesian Linear Regression Model with Local Features for Stochastic Dynamics Approximation

Behnoosh Parsa, Keshav Rajasekaran, Franziska Meier, Ashis G. Banerjee

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG

Comments 38 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1804.09401 2018-07-20 stat.ML cs.LG 50%

Generative Temporal Models with Spatial Memory for Partially Observed Environments

Marco Fraccaro, Danilo Jimenez Rezende, Yori Zwols, Alexander Pritzel, S. M. Ali Eslami, Fabio Viola

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG

Comments ICML 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.00263 2018-07-03 cs.LG stat.ML 50%

Accurate Uncertainties for Deep Learning Using Calibrated Regression

Volodymyr Kuleshov, Nathan Fenner, Stefano Ermon

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG

Comments ICML 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1706.06827 2017-07-14 cs.AI 50%

Structure Learning in Motor Control:A Deep Reinforcement Learning Model

Ari Weinstein, Matthew M. Botvinick

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.AI

Comments 39th Annual Meeting of the Cognitive Science Society, to appear

详情

展开后加载摘要…

URL PDF HTML 收藏
1703.04070 2017-07-14 cs.LG cs.AI cs.RO stat.ML 50%

Prediction and Control with Temporal Segment Models

Nikhil Mishra, Pieter Abbeel, Igor Mordatch

专题命中 模型式强化学习 :分类 cs.AI、cs.LG、cs.RO;dynamics model(abstract)

Comments camera-ready version, ICML 2017

详情

展开后加载摘要…

URL PDF HTML 收藏
1605.07127 2017-03-09 stat.ML cs.LG 50%

Learning and Policy Search in Stochastic Dynamical Systems with Bayesian Neural Networks

Stefan Depeweg, José Miguel Hernández-Lobato, Finale Doshi-Velez, Steffen Udluft

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1608.06315 2016-08-24 cs.LG q-bio.NC stat.ML 50%

LFADS - Latent Factor Analysis via Dynamical Systems

David Sussillo, Rafal Jozefowicz, L. F. Abbott, Chethan Pandarinath

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG

Comments 16 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1204.5459 2014-08-06 stat.ME stat.AP stat.CO 50%

Inference for SDE models via Approximate Bayesian Computation

Umberto Picchini

专题命中 模型式强化学习 :latent dynamics(abstract);dynamics model(abstract)

Comments Version accepted for publication in Journal of Computational & Graphical Statistics

详情

展开后加载摘要…

URL PDF HTML 收藏
1307.5118 2013-07-22 stat.ML cs.LG 50%

Model-Based Policy Gradients with Parameter-Based Exploration by Least-Squares Conditional Density Estimation

Syogo Mori, Voot Tangkaratt, Tingting Zhao, Jun Morimoto, Masashi Sugiyama

专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1004.5229 2011-09-22 cs.LG math.ST stat.ML stat.TH 50%

Optimism in Reinforcement Learning and Kullback-Leibler Divergence

Sarah Filippi, Olivier Cappé, Aurélien Garivier

专题命中 模型式强化学习 :model-based reinforcement learning(abstract);分类 cs.LG

Comments This work has been accepted and presented at ALLERTON 2010; Communication, Control, and Computing (Allerton), 2010 48th Annual Allerton Conference on, Monticello (Illinois) : États-Unis (2010)

详情

展开后加载摘要…

URL PDF HTML 收藏