arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4758 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4758 篇

2102.12425 2021-02-25 cs.LG 57%

Synthetic Returns for Long-Term Credit Assignment

David Raposo, Sam Ritter, Adam Santoro, Greg Wayne, Theophane Weber, Matt Botvinick, Hado van Hasselt, Francis Song

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.07643 2021-02-18 cs.LG stat.ML 57%

Influence-aware Memory Architectures for Deep Reinforcement Learning

Miguel Suau, Jinke He, Elena Congeduti, Rolf A. N. Starre, Aleksander Czechowski, Frans A. Oliehoek

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.07599 2021-02-16 cs.AI 57%

Seeing by haptic glance: reinforcement learning-based 3D object Recognition

Kevin Riou, Suiyi Ling, Guillaume Gallot, Patrick Le Callet

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1903.07097 2021-02-16 cs.DB cs.LG 57%

tspDB: Time Series Predict DB

Anish Agarwal, Abdullah Alomar, Devavrat Shah

专题命中 记忆与上下文管理 :workflow(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.04209 2021-02-09 cs.CY cs.AI cs.HC 57%

Guilty Artificial Minds

Michael T. Stuart, Markus Kneer

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments 20 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.08152 2021-02-05 cs.LG 57%

Rank the Episodes: A Simple Approach for Exploration in Procedurally-Generated Environments

Daochen Zha, Wenye Ma, Lei Yuan, Xia Hu, Ji Liu

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments Accepted by ICLR 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.09390 2021-02-02 cs.LG stat.ML 57%

Regime Switching Bandits

Xiang Zhou, Yi Xiong, Ningyuan Chen, Xuefeng Gao

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.09841 2021-01-26 cs.HC cs.CR cs.CY cs.LG 57%

E-cheating Prevention Measures: Detection of Cheating at Online Examinations Using Deep Learning Approach -- A Case Study

Leslie Ching Ow Tiong, HeeJeong Jasmine Lee

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.11689 2021-01-26 cs.RO cs.AI 57%

Collision Avoidance in Pedestrian-Rich Environments with Deep Reinforcement Learning

Michael Everett, Yu Fan Chen, Jonathan P. How

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments arXiv admin note: substantial text overlap with arXiv:1805.01956

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.08153 2021-01-25 cs.AI 57%

Shielding Atari Games with Bounded Prescience

Mirco Giacobbe, Mohammadhosein Hasanbeig, Daniel Kroening, Hjalmar Wijk

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments To appear at AAMAS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
1706.03661 2021-01-25 cs.AI cs.RO 57%

DAC-h3: A Proactive Robot Cognitive Architecture to Acquire and Express Knowledge About the World and the Self

Clément Moulin-Frier, Tobias Fischer, Maxime Petit, Grégoire Pointeau, Jordi-Ysard Puigbo, Ugo Pattacini, Sock Ching Low, Daniel Camilleri, Phuong Nguyen, Matej Hoffmann, Hyung Jin Chang, Martina Zambelli, Anne-Laure Mealier, Andreas Damianou, Giorgio Metta, Tony J. Prescott, Yiannis Demiris, Peter Ford Dominey, Paul F. M. J. Verschure

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

Comments Preprint version; final version available at http://ieeexplore.ieee.org/ IEEE Transactions on Cognitive and Developmental Systems (Accepted) DOI: 10.1109/TCDS.2017.2754143

Journal ref IEEE Transactions on Cognitive and Developmental Systems 10 (4), 1005-1022, 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.06812 2021-01-19 cs.LG cs.CR 57%

Explain2Attack: Text Adversarial Attacks via Cross-Domain Interpretability

Mahmoud Hossam, Trung Le, He Zhao, Dinh Phung

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments Preprint for accepted paper at 25th International Conference on Pattern Recognition (ICPR 2020)

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.08189 2021-01-15 cs.LG stat.ML 57%

Reward Prediction Error as an Exploration Objective in Deep RL

Riley Simmons-Edler, Ben Eisner, Daniel Yang, Anthony Bisulco, Eric Mitchell, Sebastian Seung, Daniel Lee

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments Published at IJCAI 2020, camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.04300 2021-01-12 cs.LG stat.ML 57%

Learning Discrete State Abstractions With Deep Variational Inference

Ondrej Biza, Robert Platt, Jan-Willem van de Meent, Lawson L. S. Wong

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.02897 2021-01-11 cs.LG cs.GT 57%

Sequential Naive Learning

Itai Arieli, Yakov Babichenko, Manuel Mueller-Frank

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.04709 2021-01-01 cs.LG cs.RO 57%

f-IRL: Inverse Reinforcement Learning via State Marginal Matching

Tianwei Ni, Harshit Sikchi, Yufei Wang, Tejus Gupta, Lisa Lee, Benjamin Eysenbach

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments The first four authors have equal contribution (orders determined by dice rolling), and the last two authors have equal advising. The paper is accepted by Conference on Robot Learning (CoRL) 2020. Project videos and code link are available at https://sites.google.com/view/f-irl/home

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.12904 2020-12-29 cs.AI 57%

Weak Human Preference Supervision For Deep Reinforcement Learning

Zehong Cao, KaiChiu Wong, Chin-Teng Lin

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments Submitting to IEEE Transactions on Neural Networks and Learning Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.12738 2020-12-24 nlin.AO cs.LG nlin.PS physics.comp-ph stat.ML 57%

Learning emergent PDEs in a learned emergent space

Felix P. Kemeth, Tom Bertalan, Thomas Thiem, Felix Dietrich, Sung Joon Moon, Carlo R. Laing, Ioannis G. Kevrekidis

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.07228 2020-12-15 cs.AI 57%

Trustworthy Preference Completion in Social Choice

Lei Li, Minghe Xue, Huanhuan Chen, Xindong Wu

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.01526 2020-12-04 cs.CV cs.AI cs.RO 57%

From Goals, Waypoints & Paths To Long Term Human Trajectory Forecasting

Karttikeya Mangalam, Yang An, Harshayu Girase, Jitendra Malik

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments 14 pages, 7 figures (including 2 GIFs)

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.13467 2020-11-30 cs.AI cs.RO 57%

Episodic Self-Imitation Learning with Hindsight

Tianhong Dai, Hengyan Liu, Anil Anthony Bharath

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.08027 2020-11-19 cs.RO cs.AI 57%

ACDER: Augmented Curiosity-Driven Experience Replay

Boyao Li, Tao Lu, Jiayi Li, Ning Lu, Yinghao Cai, Shuo Wang

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Journal ref 2020 IEEE International Conference on Robotics and Automation (ICRA2020)

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.06813 2020-11-16 cs.RO cs.CV cs.LG 57%

Learning Object Manipulation Skills via Approximate State Estimation from Real Videos

Vladimír Petrík, Makarand Tapaswi, Ivan Laptev, Josef Sivic

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments CoRL 2020, code at CoRL2020" target="_blank" rel="noopener">https://github.com/makarandtapaswi/Real2Sim_CoRL2020, project page at https://data.ciirc.cvut.cz/public/projects/2020Real2Sim/

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.04950 2020-11-11 cs.RO cs.AI cs.SY eess.SY 57%

Model-based Reinforcement Learning from Signal Temporal Logic Specifications

Parv Kapoor, Anand Balakrishnan, Jyotirmoy V. Deshmukh

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments Submitted to ICRA 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.05846 2020-11-10 cs.CV cs.LG cs.RO 57%

SSP: Single Shot Future Trajectory Prediction

Isht Dwivedi, Srikanth Malla, Behzad Dariush, Chiho Choi

专题命中 记忆与上下文管理 :autonomous agent(abstract);分类 cs.LG

Comments Accepted at IROS 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.02573 2020-11-06 cs.AI cs.MA cs.RO 57%

EEGS: A Transparent Model of Emotions

Suman Ojha, Jonathan Vitale, Mary-Anne Williams

专题命中 记忆与上下文管理 :autonomous agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.00697 2020-11-03 cs.LG stat.ML 57%

Time Series Forecasting with Stacked Long Short-Term Memory Networks

Frank Xiao

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.LG

Comments 7 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.12245 2020-10-26 q-fin.TR cs.LG stat.ML 57%

Option Hedging with Risk Averse Reinforcement Learning

Edoardo Vittori, Michele Trapletti, Marcello Restelli

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments Published to ICAIF2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.11983 2020-10-26 quant-ph cs.CC cs.LG 57%

Learnability and Complexity of Quantum Samples

Murphy Yuezhen Niu, Andrew M. Dai, Li Li, Augustus Odena, Zhengli Zhao, Vadim Smelyanskyi, Hartmut Neven, Sergio Boixo

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.08819 2020-10-20 cs.LG cs.SY eess.SY 57%

Assessment of Reward Functions in Reinforcement Learning for Multi-Modal Urban Traffic Control under Real-World limitations

Alvaro Cabrejas-Egea, Colm Connaughton

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments 8 pages, conference paper, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏