arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4746 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4746 篇

2507.15225 2025-07-31 cs.AI cs.LG cs.LO 73%

Solving Formal Math Problems by Decomposition and Iterative Reflection

Yichi Zhou, Jianqiu Zhao, Yongxin Zhang, Bohan Wang, Siran Wang, Luoxin Chen, Jiahui Wang, Haowei Chen, Allan Jie, Xinbo Zhang, Haocheng Wang, Luong Trung, Rong Ye, Phan Nhat Hoang, Huishuai Zhang, Peng Sun, Hang Li

机构 * University of science and technology of China(科学技术大学) Peking University(北京大学)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01706 2025-05-27 cs.LG cs.AI cs.MA 73%

Sable: a Performant, Efficient and Scalable Sequence Model for MARL

Omayma Mahjoub, Sasha Abramowitz, Ruan de Kock, Wiem Khlifi, Simon du Toit, Jemma Daniel, Louay Ben Nessir, Louise Beyers, Claude Formanek, Liam Clark, Arnu Pretorius

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00596 2025-05-02 cs.RO cs.AI cs.LG 73%

A Finite-State Controller Based Offline Solver for Deterministic POMDPs

Alex Schutz, Yang You, Matias Mattamala, Ipek Caliskanelli, Bruno Lacerda, Nick Hawes

机构 * University of Oxford(牛津大学) UK Atomic Energy Authority(英国原子能局)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

Comments 9 pages, 6 figures. Appendix attached. To be published in Proceedings of IJCAI 2025. For code see http://github.com/ori-goals/DetMCVI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15388 2025-04-23 cs.AI cs.LG cs.MA 73%

Investigating Relational State Abstraction in Collaborative MARL

Sharlin Utke, Jeremie Houssineau, Giovanni Montana

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Journal ref Proceedings of the AAAI Conference on Artificial Intelligence, Vol. 39 No. 20 (2025), 20947-20955

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16409 2024-12-24 cs.LG cs.AI cs.CV 73%

Uncertainty Quantification in Continual Open-World Learning

Amanda S. Rios, Ibrahima J. Ndiour, Parual Datta, Jaroslaw Sydir, Omesh Tickoo, Nilesh Ahuja

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

Comments Manuscript Under Review (full-length); Related 4-page manuscripts accepted at Neurips 2024 Non-Archival Workshops https://sites.google.com/view/continual-fomo-workshop and https://imol-workshop.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13781 2024-12-19 cs.CL cs.AI 73%

Meta-Reflection: A Feedback-Free Reflection Learning Framework

Yaoke Wang, Yun Zhu, Xintong Bao, Wenqiao Zhang, Suyang Dai, Kehan Chen, Wenqiang Li, Gang Huang, Siliang Tang, Yueting Zhuang

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04367 2024-12-06 cs.LG cs.AI cs.MA 73%

Machine Theory of Mind for Autonomous Cyber-Defence

Luke Swaby, Matthew Stewart, Daniel Harrold, Chris Willis, Gregory Palmer

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments 29 pages, 17 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02875 2024-12-05 cs.LG cs.AI cs.CR 73%

Out-of-Distribution Detection for Neurosymbolic Autonomous Cyber Agents

Ankita Samaddar, Nicholas Potteiger, Xenofon Koutsoukos

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments 9 pages, 10 figures, IEEE International Conference on AI in Cybersecurity (ICAIC), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22912 2024-10-31 cs.AI cs.GT cs.LG 73%

Self-optimization in distributed manufacturing systems using Modular State-based Stackelberg Games

Steve Yuwono, Ahmar Kamal Hussain, Dorothea Schwung, Andreas Schwung

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments This pre-print was submitted to Journal of Manufacturing Systems on October 30, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10107 2024-10-24 cs.LG cs.AI cs.SY eess.SY stat.ML 73%

Posterior Sampling-based Online Learning for Episodic POMDPs

Dengwang Tang, Dongze Ye, Rahul Jain, Ashutosh Nayyar, Pierluigi Nuzzo

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments 41 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10015 2024-06-17 cs.LG cs.AI cs.GT 73%

Gradient-based Learning in State-based Potential Games for Self-Learning Production Systems

Steve Yuwono, Marlon Löppenberg, Dorothea Schwung, Andreas Schwung

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.08015 2024-05-15 cs.LG cs.AI 73%

A Methodology-Oriented Study of Catastrophic Forgetting in Incremental Deep Neural Networks

Ashutosh Kumar, Sonali Agarwal, D Jude Hemanth

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15597 2024-04-25 cs.NE cs.AI cs.LG cs.MA 73%

GRSN: Gated Recurrent Spiking Neurons for POMDPs and MARL

Lang Qin, Ziming Wang, Runhao Jiang, Rui Yan, Huajin Tang

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08227 2024-02-20 cs.LG cs.AI cs.CV 73%

VERSE: Virtual-Gradient Aware Streaming Lifelong Learning with Anytime Inference

Soumya Banerjee, Vinay K. Verma, Avideep Mukherjee, Deepak Gupta, Vinay P. Namboodiri, Piyush Rai

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14509 2023-10-24 cs.LG cs.AI 73%

Iteratively Learn Diverse Strategies with State Distance Information

Wei Fu, Weihua Du, Jingwei Li, Sunli Chen, Jingzhao Zhang, Yi Wu

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.07440 2023-10-18 cs.PF cs.AI cs.LG 73%

Optimizing Memory Mapping Using Deep Reinforcement Learning

Pengming Wang, Mikita Sazanovich, Berkin Ilbeyi, Phitchaya Mangpo Phothilimthana, Manish Purohit, Han Yang Tay, Ngân Vũ, Miaosen Wang, Cosmin Paduraru, Edouard Leurent, Anton Zhernov, Po-Sen Huang, Julian Schrittwieser, Thomas Hubert, Robert Tung, Paula Kurylowicz, Kieran Milan, Oriol Vinyals, Daniel J. Mankowitz

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06203 2023-10-02 cs.RO cs.AI cs.LG stat.AP stat.ML 73%

Towards a Causal Probabilistic Framework for Prediction, Action-Selection & Explanations for Robot Block-Stacking Tasks

Ricardo Cannizzaro, Jonathan Routley, Lars Kunze

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments 4 pages, 4 figures, camera-ready manuscript, accepted to the "Causality for Robotics: Answering the Question of Why" workshop at the 2023 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.03673 2023-06-23 cs.LG cs.AI cs.GT cs.MA stat.ML 73%

Breaking the Curse of Multiagents in a Large State Space: RL in Markov Games with Independent Linear Function Approximation

Qiwen Cui, Kaiqing Zhang, Simon S. Du

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments 51 pages. Update: Accepted for presentation at the Conference on Learning Theory (COLT) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17537 2023-06-13 cs.LG cs.AI 73%

Modeling Dynamic Environments with Scene Graph Memory

Andrey Kurenkov, Michael Lingelbach, Tanmay Agarwal, Emily Jin, Chengshu Li, Ruohan Zhang, Li Fei-Fei, Jiajun Wu, Silvio Savarese, Roberto Martín-Martín

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.13758 2023-02-02 cs.AI cs.LG 73%

Learning, Fast and Slow: A Goal-Directed Memory-Based Approach for Dynamic Environments

John Chong Min Tan, Mehul Motani

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.15339 2022-11-29 cs.LG cs.AI cs.RO 73%

Discovering Generalizable Spatial Goal Representations via Graph-based Active Reward Learning

Aviv Netanyahu, Tianmin Shu, Joshua Tenenbaum, Pulkit Agrawal

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

Comments ICML 2022, the first two authors contributed equally, project page https://www.tshu.io/GEM

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.06917 2022-10-14 cs.AI cs.LG 73%

A Direct Approximation of AIXI Using Logical State Abstractions

Samuel Yang-Zhao, Tianyu Wang, Kee Siong Ng

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.01907 2022-10-06 cs.LG cs.AI cs.GT 73%

A Self-Play Posterior Sampling Algorithm for Zero-Sum Markov Games

Wei Xiong, Han Zhong, Chengshuai Shi, Cong Shen, Tong Zhang

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments Accepted to ICML 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.08713 2022-09-12 cs.LG cs.AI 73%

Learning Generative Models for Active Inference using Tensor Networks

Samuel T. Wauthier, Bram Vanhecke, Tim Verbelen, Bart Dhoedt

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments Accepted as a workshop paper at IWAI2022 @ ECML/PKDD2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.04361 2022-07-12 cs.RO cs.AI cs.LG 73%

State Dropout-Based Curriculum Reinforcement Learning for Self-Driving at Unsignalized Intersections

Shivesh Khaitan, John M. Dolan

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

Comments 2022 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 6 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.06660 2021-05-17 cs.AI cs.LG 73%

Estimating Disentangled Belief about Hidden State and Hidden Task for Meta-RL

Kei Akuzawa, Yusuke Iwasawa, Yutaka Matsuo

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments accepted to L4DC2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.03662 2021-04-21 cs.LG cs.AI cs.NE stat.ML 73%

Rapid Task-Solving in Novel Environments

Sam Ritter, Ryan Faulkner, Laurent Sartran, Adam Santoro, Matt Botvinick, David Raposo

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.00540 2021-04-02 cs.LG cs.AI cs.SY eess.SY math.OC 73%

Reinforcement Learning Beyond Expectation

Bhaskar Ramasubramanian, Luyao Niu, Andrew Clark, Radha Poovendran

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.04422 2021-03-16 cs.CE cs.AI cs.LG 73%

Automated Synthesis of Steady-State Continuous Processes using Reinforcement Learning

Quirin Göttl, Dominik G. Grimm, Jakob Burger

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.07764 2021-02-18 cs.RO cs.AI cs.CV cs.LG cs.NE 73%

End-to-End Egospheric Spatial Memory

Daniel Lenton, Stephen James, Ronald Clark, Andrew J. Davison

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments Conference paper at ICLR 2021. Implementation: https://github.com/ivy-dl/memory Project page: https://djl11.github.io/ESM/

详情

展开后加载摘要…

URL PDF HTML 收藏