arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4758 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4758 篇

2503.02631 2025-10-31 cs.HC cs.AI 57%

Reflection on Data Storytelling Tools in the Generative AI Era from the Human-AI Collaboration Perspective

Haotian Li, Yun Wang, Huamin Qu

机构 * Microsoft Research Asia(微软亚洲研究院) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 记忆与上下文管理 :workflow(abstract);分类 cs.AI

Comments This paper is a sequel to the CHI 24 paper "Where Are We So Far? Understanding Data Storytelling Tools from the Perspective of Human-AI Collaboration (https://doi.org/10.1145/3613904.3642726), aiming to refresh our understanding with the latest advancements. It is accepted at IEEE VIS 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19497 2025-10-23 cs.MA cs.AI 57%

Modeling realistic human behavior using generative agents in a multimodal transport system: Software architecture and Application to Toulouse

Trung-Dung Vu, Benoit Gaudou, Kamaldeep Singh Oberoi

机构 * UMR IRIT University Toulouse Capitole(IRIT大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23804 2025-10-22 cs.CR cs.CL cs.IR cs.MA 57%

DrunkAgent: Stealthy Memory Corruption in LLM-Powered Recommender Agents

Shiyi Yang, Zhibo Hu, Xinshu Li, Chen Wang, Tong Yu, Xiwei Xu, Liming Zhu, Lina Yao

机构 * The University of New South Wales(新南威尔士大学) Macquarie University(麦考瑞大学) Adobe Research(Adobe研究)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11039 2025-10-21 cs.LG 57%

Model Predictive Task Sampling for Efficient and Robust Adaptation

Qi Wang, Zehao Xiao, Yixiu Mao, Yun Qu, Jiayi Shen, Yiqin Lv, Xiangyang Ji

机构 * Department of Automation, Tsinghua University(自动化系,清华大学) Informatics Institute, University of Amsterdam(信息学院,阿姆斯特丹大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15772 2025-10-20 cs.AI 57%

Self-evolving expertise in complex non-verifiable subject domains: dialogue as implicit meta-RL

Richard M. Bailey

机构 * University of Oxford(牛津大学)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

Comments 50 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15006 2025-10-20 cs.LG 57%

ES-C51: Expected Sarsa Based C51 Distributional Reinforcement Learning Algorithm

Rijul Tandon, Peter Vamplew, Cameron Foale

机构 * UIET, Panjab University , Chandigarh , India(旁遮普大学UIET,昌迪加尔,印度) Federation University, Victoria, Australia(联邦大学,维多利亚,澳大利亚)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14611 2025-10-17 cs.HC cs.AI 57%

An Active Inference Model of Mouse Point-and-Click Behaviour

Markus Klar, Sebastian Stein, Fraser Paterson, John H. Williamson, Roderick Murray-Smith

机构 * University of Glasgow(格拉斯哥大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Comments 12 pages + Appendix; Accepted to 6th International Workshop on Active Inference (IWAI 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13363 2025-10-16 cs.CL 57%

D-SMART: Enhancing LLM Dialogue Consistency via Dynamic Structured Memory And Reasoning Tree

Xiang Lei, Qin Li, Min Zhang, Min Zhang

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.CL

Comments 8 pages, 6 figures (main content); 25 pages, 18 figures (total)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13392 2025-10-14 cs.CL 57%

Judgment of Learning: A Human Ability Beyond Generative Artificial Intelligence

Markus Huff, Elanur Ulakçı

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

Comments 24 pages, 2 figures

Journal ref Scientific Reports, 15(1), 35030 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16067 2025-10-14 cs.AI 57%

How Memory Management Impacts LLM Agents: An Empirical Study of Experience-Following Behavior

Zidi Xiong, Yuping Lin, Wenya Xie, Pengfei He, Zirui Liu, Jiliang Tang, Himabindu Lakkaraju, Zhen Xiang

机构 * Harvard University(哈佛大学) University of Georgia(佐治亚大学) Michigan State University(密歇根州立大学) University of Minnesota-Twin Cities(明尼苏达大学双城分校)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07266 2025-10-09 cs.LG cs.GT 57%

Dynamic Regret Bounds for Online Omniprediction with Long Term Constraints

Yahav Bechavod, Jiuyao Lu, Aaron Roth

机构 * Department of Computer and Information Sciences, University of Pennsylvania(计算机与信息科学系,宾夕法尼亚大学) Department of Statistics and Data Science, University of Pennsylvania(统计与数据科学系,宾夕法尼亚大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06664 2025-10-09 cs.CL 57%

ToolMem: Enhancing Multimodal Agents with Learnable Tool Capability Memory

Yunzhong Xiao, Yangmin Li, Hewei Wang, Yunlong Tang, Zora Zhiruo Wang

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Rochester(罗切斯特大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15492 2025-10-09 cs.LG cs.OS 57%

Reinforcement Learning for Dynamic Memory Allocation

Arisrei Lim, Abhiram Maddukuri

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03286 2025-10-07 q-bio.NC cs.AI 57%

A Biologically Interpretable Cognitive Architecture for Online Structuring of Episodic Memories into Cognitive Maps

E. A. Dzhivelikian, A. I. Panov

机构 * Cognitive AI Lab(认知人工智能实验室)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25911 2025-10-01 cs.CL 57%

Mem-α: Learning Memory Construction via Reinforcement Learning

Yu Wang, Ryuichi Takanobu, Zhiqi Liang, Yuzhen Mao, Yuanzhe Hu, Julian McAuley, Xiaojian Wu

机构 * Anuttacon University of California San Diego(加州大学圣地亚哥分校) Stanford University(斯坦福大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02831 2025-09-30 cs.LG 57%

Meta-Learning to Explore via Memory Density Feedback

Kevin McKee, Eric Alt, Andrew Grebenisan, Mick van Gelderen, Gary Miguel

机构 * Astera Institute(Astera研究所)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments 17 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.00356 2025-09-30 q-fin.CP cs.LG 57%

A Deep Reinforcement Learning Trader without Offline Training

Boian Lazov

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments 17 pages, 5 figures, full Mathematica code included

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12642 2025-09-30 eess.IV cs.AI cs.CV 57%

COVID-19 Pneumonia Diagnosis Using Medical Images: Deep Learning-Based Transfer Learning Approach

Anjali Dharmik

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

Journal ref JMIRx Med. 29/08/2025:75015

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21224 2025-09-26 cs.AI 57%

What Do LLM Agents Do When Left Alone? Evidence of Spontaneous Meta-Cognitive Patterns

Stefan Szeider

机构 * Algorithms and Complexity Group TU Wien(算法与复杂性组维也纳技术大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21129 2025-09-26 cs.LG cs.CR 57%

EvoMail: Self-Evolving Cognitive Agents for Adaptive Spam and Phishing Email Defense

Wei Huang, De-Tian Chu, Lin-Yuan Bai, Wei Kang, Hai-Tao Zhang, Bo Li, Zhi-Mo Han, Jing Ge, Hai-Feng Lin

机构 * People’s Liberation Army 77606 Unit(中国人民解放军77606单位) Field Engineering College, Army Engineering University of PLA(陆军工程大学工程学院) College Of Software, ZhengZhou University of Light Industry(郑州轻工业大学软件学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20754 2025-09-26 cs.AI cs.RO 57%

Meta-Memory: Retrieving and Integrating Semantic-Spatial Memories for Robot Spatial Reasoning

Yufan Mao, Hanjing Ye, Wenlong Dong, Chengjie Zhang, Hong Zhang

机构 * Southern University of Science and Technology(南方科技大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09447 2025-09-26 cs.AI cs.CV cs.RO 57%

Online Language Splatting

Saimouli Katragadda, Cho-Ying Wu, Yuliang Guo, Xinyu Huang, Guoquan Huang, Liu Ren

机构 * University of Delaware(德克萨斯大学) Bosch Research North America & Bosch Center for Artificial Intelligence (BCAI)(博世北美研究部及博世人工智能中心(BCAI))

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18907 2025-09-26 cs.AI cs.CV cs.RO 57%

EC-Diffuser: Multi-Object Manipulation via Entity-Centric Behavior Generation

Carl Qi, Dan Haramati, Tal Daniel, Aviv Tamar, Amy Zhang

机构 * UT Austin(得克萨斯大学) Technion, Israel Institute of Technology(技术学院,以色列技术学院) Brown University(布朗大学) Meta AI

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16393 2025-09-23 cs.LG stat.AP 57%

Federated Learning for Financial Forecasting

Manuel Noseda, Alberto De Luca, Lukas Von Briel, Nathan Lacour

机构 * ETH Zürich(苏黎世联邦理工学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16206 2025-09-23 cs.CE cs.LG 57%

Deep Reinforcement Learning in Factor Investment

Junlin Liu

机构 * Georgetown University(乔治城大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15291 2025-09-22 cs.AI cs.SY eess.SY 57%

The Distribution Shift Problem in Transportation Networks using Reinforcement Learning and AI

Federico Taschin, Abderrahmane Lazaraq, Ozan K. Tonguz, Inci Ozgunes

机构 * Carnegie Mellon University(卡内基梅隆大学) KTH Royal Institute of Technology(皇家理工学院)

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12132 2025-09-16 cs.CV cs.CL 57%

Look Again, Think Slowly: Enhancing Visual Reflection in Vision-Language Models

Pu Jian, Junhong Wu, Wei Sun, Chen Wang, Shuo Ren, Jiajun Zhang

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

Comments EMNLP2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09176 2025-09-15 cs.LG cs.CY 57%

Quantum-Enhanced Forecasting for Deep Reinforcement Learning in Algorithmic Trading

Jun-Hao Chen, Yu-Chien Huang, Yun-Cheng Tsai, Samuel Yen-Chi Chen

机构 * National Taiwan Normal University(台湾师范大学) Wells Fargo(摩根大通)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19116 2025-09-09 cs.LG stat.ML 57%

A Theoretical Justification for Asymmetric Actor-Critic Algorithms

Gaspard Lambrechts, Damien Ernst, Aditya Mahajan

机构 * Montefiore Institute, University of Liège(利根大学蒙特菲尔研究所) Department of Electrical and Computer Engineering, McGill University(麦吉尔大学电气与计算机工程系)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments 8 pages, 31 pages total

Journal ref International Conference on Machine Learning, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01086 2025-09-04 cs.LG cs.SY eess.SY 57%

MPCritic: A plug-and-play MPC architecture for reinforcement learning

Nathan P. Lawrence, Thomas Banker, Ali Mesbah

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

Comments CDC 2025 final version

详情

展开后加载摘要…

URL PDF HTML 收藏