arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4753 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4753 篇

2102.09370 2021-02-19 cs.HC cs.AI cs.LG 62%

A Study on the Manifestation of Trust in Speech

Lara Gauder, Leonardo Pepino, Pablo Riera, Silvina Brussino, Jazmín Vidal, Agustín Gravano, Luciana Ferrer

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments arXiv admin note: text overlap with arXiv:2007.15711, arXiv:2006.05977

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.08072 2021-02-17 cs.LG cs.AI cs.RO cs.SY eess.SY 62%

Steadily Learn to Drive with Virtual Memory

Yuhang Zhang, Yao Mu, Yujie Yang, Yang Guan, Shengbo Eben Li, Qi Sun, Jianyu Chen

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments Submitted to the 32nd IEEE Intelligent Vehicles Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.10247 2021-02-16 cs.LG cs.AI stat.ML 62%

Memory Based Trajectory-conditioned Policies for Learning from Sparse Rewards

Yijie Guo, Jongwook Choi, Marcin Moczulski, Shengyu Feng, Samy Bengio, Mohammad Norouzi, Honglak Lee

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.03719 2021-02-09 cs.LG cs.AI 62%

State-Aware Variational Thompson Sampling for Deep Q-Networks

Siddharth Aravindan, Wee Sun Lee

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.01839 2021-02-09 cs.LG cs.AI stat.ML 62%

Expected Eligibility Traces

Hado van Hasselt, Sephora Madjiheurem, Matteo Hessel, David Silver, André Barreto, Diana Borsa

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments AAAI, distinguished paper award

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.12719 2021-02-04 cs.LG cs.AI cs.NE stat.ML 62%

Augmented Replay Memory in Reinforcement Learning With Continuous Control

Mirza Ramicic, Andrea Bonarini

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Journal ref IEEE Transactions on Cognitive and Developmental Systems (2021) 1-12

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.08452 2021-01-22 cs.LG cs.AI stat.ML 62%

Robust Reinforcement Learning on State Observations with Learned Optimal Adversary

Huan Zhang, Hongge Chen, Duane Boning, Cho-Jui Hsieh

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted by ICLR 2021. Huan Zhang and Hongge Chen contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.04454 2021-01-21 cs.LG cs.AI 62%

Learning Intuitive Physics with Multimodal Generative Models

Sahand Rezaei-Shoshtari, Francois Robert Hogan, Michael Jenkin, David Meger, Gregory Dudek

专题命中 记忆与上下文管理 :autonomous agent(abstract);分类 cs.AI、cs.LG

Comments AAAI 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.06162 2021-01-18 cs.LG cs.AI cs.CV 62%

Learning Invariant Representation for Continual Learning

Ghada Sokar, Decebal Constantin Mocanu, Mykola Pechenizkiy

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted at the AAAI Meta-Learning for Computer Vision Workshop (2021)

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.06631 2021-01-14 cs.LG cs.AI 62%

Steady State Analysis of Episodic Reinforcement Learning

Huang Bojun

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.13957 2021-01-12 cs.LG cs.AI cs.CV cs.RO 62%

MELD: Meta-Reinforcement Learning from Images via Latent State Models

Tony Z. Zhao, Anusha Nagabandi, Kate Rakelly, Chelsea Finn, Sergey Levine

专题命中 记忆与上下文管理 :autonomous agent(abstract);分类 cs.AI、cs.LG

Comments Accepted to CoRL 2020. Supplementary material at https://sites.google.com/view/meld-lsm/home . 16 pages, 19 figures. V2: add funding acknowledgements, reduce file size

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.03168 2021-01-05 cs.LG cs.AI cs.RO cs.SY eess.SY math.OC 62%

Neural Stochastic Contraction Metrics for Learning-based Control and Estimation

Hiroyasu Tsukamoto, Soon-Jo Chung, Jean-Jacques E. Slotine

专题命中 记忆与上下文管理 :autonomous agent(abstract);分类 cs.AI、cs.LG

Comments IEEE CONTROL SYSTEMS LETTERS (L-CSS), preprint version, accepted Dec. 2020 (DOI: 10.1109/LCSYS.2020.3046529). https://ieeexplore.ieee.org/document/9302618

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.14259 2020-12-30 eess.SP cs.AI cs.LG 62%

Intelligent Residential Energy Management System using Deep Reinforcement Learning

Alwyn Mathew, Abhijit Roy, Jimson Mathew

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.08621 2020-12-17 cs.LG cs.AI stat.ML 62%

BeBold: Exploration Beyond the Boundary of Explored Regions

Tianjun Zhang, Huazhe Xu, Xiaolong Wang, Yi Wu, Kurt Keutzer, Joseph E. Gonzalez, Yuandong Tian

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.02757 2020-12-07 cs.AI cs.CL 62%

Playing Text-Based Games with Common Sense

Sahith Dambekodi, Spencer Frazier, Prithviraj Ammanabrolu, Mark O. Riedl

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.04361 2020-11-20 eess.SY cs.AI cs.LG cs.RO cs.SY math.OC 62%

Neural Contraction Metrics for Robust Estimation and Control: A Convex Optimization Approach

Hiroyasu Tsukamoto, Soon-Jo Chung

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI、cs.LG

Comments IEEE Control Systems Letters (L-CSS). Preprint version, accepted June 2020

Journal ref IEEE Control Systems Letters, vol. 5, no. 1, pp. 211-216, Jan. 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.03506 2020-11-09 cs.LG cs.AI 62%

The Value Equivalence Principle for Model-Based Reinforcement Learning

Christopher Grimm, André Barreto, Satinder Singh, David Silver

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI、cs.LG

Comments NeurIPS-2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.09786 2020-11-04 cs.RO cs.AI cs.LG 62%

Reinforcement Learning with Uncertainty Estimation for Tactical Decision-Making in Intersections

Carl-Johan Hoel, Tommy Tram, Jonas Sjöberg

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Journal ref IEEE Intelligent Transportation Systems Conference (ITSC), 2020, pp. 318-324

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.16324 2020-11-02 cs.CL cs.LG 62%

Topic-Preserving Synthetic News Generation: An Adversarial Deep Reinforcement Learning Approach

Ahmadreza Mosallanezhad, Kai Shu, Huan Liu

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL、cs.LG

Comments 10 pages, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.07911 2020-10-28 cs.LG cs.AI cs.RO stat.ML 62%

Generating Automatic Curricula via Self-Supervised Active Domain Randomization

Sharath Chandra Raparthy, Bhairav Mehta, Florian Golemo, Liam Paull

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.12484 2020-10-27 cs.LG cs.AI math.OC stat.ML 62%

Sample-Efficient Reinforcement Learning of Undercomplete POMDPs

Chi Jin, Sham M. Kakade, Akshay Krishnamurthy, Qinghua Liu

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments To appear at NeurIPS 2020 as spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.11812 2020-10-26 cs.LG cs.AI stat.ML 62%

Self-Paced Deep Reinforcement Learning

Pascal Klink, Carlo D'Eramo, Jan Peters, Joni Pajarinen

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.11223 2020-10-23 cs.AI cs.LG cs.NE 62%

Meta-trained agents implement Bayes-optimal agents

Vladimir Mikulik, Grégoire Delétang, Tom McGrath, Tim Genewein, Miljan Martic, Shane Legg, Pedro A. Ortega

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments Published at 34th Conference on Neural Information Processing Systems (NeurIPS 2020), Vancouver, Canada

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.08497 2020-10-19 cs.LG cs.AI q-fin.MF 62%

AAMDRL: Augmented Asset Management with Deep Reinforcement Learning

Eric Benhamou, David Saltiel, Sandrine Ungari, Abhishek Mukhopadhyay, Jamal Atif

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments 9 pages, 7 figures. arXiv admin note: substantial text overlap with arXiv:2009.14136

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.01719 2020-10-15 cs.CL cs.AI 62%

Grounded Language Learning Fast and Slow

Felix Hill, Olivier Tieleman, Tamara von Glehn, Nathaniel Wong, Hamza Merzic, Stephen Clark

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.02260 2020-10-07 cs.CL cs.AI 62%

Effects of Naturalistic Variation in Goal-Oriented Dialog

Jatin Ganhotra, Robert Moore, Sachindra Joshi, Kahini Wadhawan

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

Comments Findings of EMNLP 2020. The updated datasets are available at: https://github.com/IBM/naturalistic-variation-goal-oriented-dialog-datasets

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.01753 2020-10-06 cs.LG cs.AI 62%

The act of remembering: a study in partially observable reinforcement learning

Rodrigo Toro Icarte, Richard Valenzano, Toryn Q. Klassen, Phillip Christoffersen, Amir-massoud Farahmand, Sheila A. McIlraith

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.11896 2020-09-28 cs.LG cs.CL stat.ML 62%

Bootstrapped Q-learning with Context Relevant Observation Pruning to Generalize in Text-based Games

Subhajit Chaudhury, Daiki Kimura, Kartik Talamadupula, Michiaki Tatsubori, Asim Munawar, Ryuki Tachibana

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL、cs.LG

Comments Accepted to EMNLP 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.11348 2020-09-25 cs.LG cs.AI cs.SY eess.SY stat.ML 62%

A Sample-Efficient Algorithm for Episodic Finite-Horizon MDP with Constraints

Krishna C. Kalagarla, Rahul Jain, Pierluigi Nuzzo

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1605.05365 2020-09-23 cs.LG cs.AI cs.NE 62%

Dynamic Frame skip Deep Q Network

Aravind Srinivas, Sahil Sharma, Balaraman Ravindran

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments IJCAI 2016 Workshop on Deep Reinforcement Learning: Frontiers and Challenges; 6 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏