arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4758 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4758 篇

1810.05394 2018-10-15 cs.LG cs.CV cs.RO stat.ML 57%

Sequential Learning of Movement Prediction in Dynamic Environments using LSTM Autoencoder

Meenakshi Sarkar, Debasish Ghose

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.06939 2018-10-01 cs.CV cs.LG 57%

Bayesian Prediction of Future Street Scenes through Importance Sampling based Optimization

Apratim Bhattacharyya, Mario Fritz, Bernt Schiele

专题命中 记忆与上下文管理 :autonomous agent(abstract);分类 cs.LG

Comments The objective in (8) allows for trivial solutions e.g. the prior

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.05872 2018-09-18 cs.LG stat.ML 57%

Inspiration Learning through Preferences

Nir Baram, Shie Mannor

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1803.00119 2018-07-31 cs.AI cs.RO 57%

Integrating Human-Provided Information Into Belief State Representation Using Dynamic Factorization

Rohan Chitnis, Leslie Pack Kaelbling, Tomás Lozano-Pérez

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

Comments IROS 2018 final version

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.02787 2018-07-10 q-fin.TR cs.LG stat.ML 57%

Financial Trading as a Game: A Deep Reinforcement Learning Approach

Chien Yi Huang

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1805.11016 2018-06-04 cs.LG stat.ML 57%

Memory Augmented Self-Play

Shagun Sodhani, Vardaan Pahuja

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.04348 2018-05-29 cs.CL 57%

Natural Language Inference over Interaction Space

Yichen Gong, Heng Luo, Jian Zhang

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

Comments 15 pages, 2 figures, under review as ICLR proceeding, Published at Sixth International Conference on Learning Representations, ICLR 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1805.06020 2018-05-22 cs.AI 57%

Do deep reinforcement learning agents model intentions?

Tambet Matiisen, Aqeel Labash, Daniel Majoral, Jaan Aru, Raul Vicente

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1803.00268 2018-04-27 cs.AI cs.RO 57%

Representation Learning in Partially Observable Environments using Sensorimotor Prediction

Thibaut Kulak, Michael Garcia Ortiz

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1804.07881 2018-04-24 cs.CL 57%

Event Extraction with Generative Adversarial Imitation Learning

Tongtao Zhang, Heng Ji

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
1804.06512 2018-04-19 cs.CL 57%

Dialogue Learning with Human Teaching and Feedback in End-to-End Trainable Task-Oriented Dialogue Systems

Bing Liu, Gokhan Tur, Dilek Hakkani-Tur, Pararth Shah, Larry Heck

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

Comments To appear in NAACL 2018 as a long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
1804.02813 2018-04-10 cs.HC cs.LG cs.NE 57%

An Adaptive Learning Method of Personality Trait Based Mood in Mental State Transition Network by Recurrent Neural Network

Takumi Ichimura, Kosuke Tanabe, Toshiyuki Yamashita

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments 6 pages, 9 figures, Proc. of IEEE 7th International Workshop on Computational Intelligence and Applications (IWCIA2014)

详情

展开后加载摘要…

URL PDF HTML 收藏
1803.03916 2018-03-13 cs.LG stat.ML 57%

Deep reinforcement learning for time series: playing idealized trading games

Xiang Gao

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.05706 2018-02-15 cs.AI 57%

Memory Augmented Control Networks

Arbaaz Khan, Clark Zhang, Nikolay Atanasov, Konstantinos Karydis, Vijay Kumar, Daniel D. Lee

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.01308 2018-02-13 cs.AI 57%

BOOK: Storing Algorithm-Invariant Episodes for Deep Reinforcement Learning

Simyung Chang, YoungJoon Yoo, Jaeseok Choi, Nojun Kwak

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1801.07747 2018-01-25 cs.MA cs.AI 57%

Quantified Degrees of Group Responsibility (Extended Abstract)

Vahid Yazdanpanah, Mehdi Dastani

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments Presented in the 27th Belgian-Netherlands Conference on Artificial Intelligence (BNAIC 2015), Hasselt, Belgium

详情

展开后加载摘要…

URL PDF HTML 收藏
1801.03138 2018-01-11 cs.AI 57%

Deep In-GPU Experience Replay

Ben Parr

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments Source code (uses TensorFlow): https://github.com/bparr/gpu-experience-replay

详情

展开后加载摘要…

URL PDF HTML 收藏
1712.01169 2017-12-05 cs.LG stat.ML 57%

Episodic memory for continual model learning

David G. Nagy, Gergő Orbán

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments CLDL at NIPS 2016

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.01490 2017-11-02 cs.AI 57%

Active Exploration for Learning Symbolic Representations

Garrett Andersen, George Konidaris

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1710.07328 2017-10-23 cs.GT cs.LG math.OC 57%

Online Monotone Games

Ian Gemp, Sridhar Mahadevan

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1710.02210 2017-10-09 cs.AI 57%

Exploration in Feature Space for Reinforcement Learning

Suraj Narayanan Sasikumar

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments Masters thesis. Australian National University, May 2017. 65 pp

详情

展开后加载摘要…

URL PDF HTML 收藏
1612.03653 2017-09-22 cs.AI cs.RO 57%

Learning to Drive using Inverse Reinforcement Learning and Deep Q-Networks

Sahand Sharifzadeh, Ioannis Chiotellis, Rudolph Triebel, Daniel Cremers

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments NIPS workshop on Deep Learning for Action and Interaction, 2016

详情

展开后加载摘要…

URL PDF HTML 收藏
1707.07767 2017-07-26 cs.LG cs.RO 57%

Bellman Gradient Iteration for Inverse Reinforcement Learning

Kun Li, Yanan Sui, Joel W. Burdick

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1706.08090 2017-06-27 cs.AI 57%

Count-Based Exploration in Feature Space for Reinforcement Learning

Jarryd Martin, Suraj Narayanan Sasikumar, Tom Everitt, Marcus Hutter

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments Conference: Twenty-sixth International Joint Conference on Artificial Intelligence (IJCAI-17), 8 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
1703.01310 2017-06-15 cs.AI 57%

Count-Based Exploration with Neural Density Models

Georg Ostrovski, Marc G. Bellemare, Aaron van den Oord, Remi Munos

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1706.04081 2017-06-14 math.OC cs.LG math.ST stat.TH 57%

Interaction-Based Distributed Learning in Cyber-Physical and Social Networks

Francesco Sasso, Angelo Coluccia, Giuseppe Notarstefano

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1705.05690 2017-06-12 cs.NI cs.LG 57%

A Long Short-Term Memory Recurrent Neural Network Framework for Network Traffic Matrix Prediction

Abdelhadi Azzouni, Guy Pujolle

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.LG

Comments Submitted for peer review. arXiv admin note: text overlap with arXiv:1402.1128 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
1705.09724 2017-05-30 cs.CL 57%

Semi-Supervised Model Training for Unbounded Conversational Speech Recognition

Shane Walker, Morten Pedersen, Iroro Orife, Jason Flaks

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
1705.08498 2017-05-25 cs.LG 57%

Clinical Intervention Prediction and Understanding using Deep Networks

Harini Suresh, Nathan Hunt, Alistair Johnson, Leo Anthony Celi, Peter Szolovits, Marzyeh Ghassemi

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1703.02239 2017-05-17 cs.AI 57%

Functions that Emerge through End-to-End Reinforcement Learning - The Direction for Artificial General Intelligence -

Katsunari Shibata

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

Comments The Multi-disciplinary Conference on Reinforcement Learning and Decision Making (RLDM) 2017, 5 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏