arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4753 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4753 篇

2501.11533 2025-01-22 cs.AI cs.LG 62%

The impact of intrinsic rewards on exploration in Reinforcement Learning

Aya Kayal, Eduardo Pignatelli, Laura Toni

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments 45 pages, 17 figures. Submitted to Neural Computing and Applications Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18313 2025-01-22 cs.RO cs.AI cs.LG 62%

Embodied-RAG: General Non-parametric Embodied Memory for Retrieval and Generation

Quanting Xie, So Yeon Min, Pengliang Ji, Yue Yang, Tianyi Zhang, Kedi Xu, Aarav Bajaj, Ruslan Salakhutdinov, Matthew Johnson-Roberson, Yonatan Bisk

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments Web: https://quanting-xie.github.io/Embodied-RAG-web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16485 2025-01-17 cs.LG cs.AI cs.RO 62%

Learning Constraint Network from Demonstrations via Positive-Unlabeled Learning with Memory Replay

Baiyu Peng, Aude Billard

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01463 2025-01-06 cs.LG cs.AI cs.MA 62%

Goal Recognition using Actor-Critic Optimization

Ben Nageris, Felipe Meneguzzi, Reuth Mirsky

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09972 2025-01-03 cs.LG cs.AI 62%

Efficient Large-Scale Traffic Forecasting with Transformers: A Spatial Data Management Perspective

Yuchen Fang, Yuxuan Liang, Bo Hui, Zezhi Shao, Liwei Deng, Xu Liu, Xinke Jiang, Kai Zheng

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI、cs.LG

Comments Accepted by SIGKDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19226 2024-12-30 cs.NI cs.AI cs.CV cs.LG 62%

VINEVI: A Virtualized Network Vision Architecture for Smart Monitoring of Heterogeneous Applications and Infrastructures

Rodrigo Moreira, Hugo G. V. O. da Cunha, Larissa F. Rodrigues Moreira, Flávio de Oliveira Silva

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments 12 pages

Journal ref International Conference on Advanced Information Networking and Applications (AINA-2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09498 2024-12-24 cs.SI cs.AI cs.CL 62%

From Skepticism to Acceptance: Simulating the Attitude Dynamics Toward Fake News

Yuhan Liu, Xiuying Chen, Xiaoqing Zhang, Xing Gao, Ji Zhang, Rui Yan

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

Comments IJCAI 2024 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14085 2024-12-19 cs.LG cs.AI cs.HC 62%

Future Research Avenues for Artificial Intelligence in Digital Gaming: An Exploratory Report

Markus Dablander

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12700 2024-12-18 cs.LG cs.AI 62%

ParMod: A Parallel and Modular Framework for Learning Non-Markovian Tasks

Ruixuan Miao, Xu Lu, Cong Tian, Bin Yu, Zhenhua Duan

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00554 2024-12-10 cs.CL cs.AI 62%

Unveiling Performance Challenges of Large Language Models in Low-Resource Healthcare: A Demographic Fairness Perspective

Yue Zhou, Barbara Di Eugenio, Lu Cheng

专题命中 记忆与上下文管理 :autonomous agent(abstract);分类 cs.AI、cs.CL

Comments Accepted to the main conference of COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04974 2024-12-09 cs.LG cs.AI cs.RO 62%

Putting the Iterative Training of Decision Trees to the Test on a Real-World Robotic Task

Raphael C. Engelhardt, Marcel J. Meinen, Moritz Lange, Laurenz Wiskott, Wolfgang Konen

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments 5 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03715 2024-12-06 cs.LG cs.AI 62%

PathletRL++: Optimizing Trajectory Pathlet Extraction and Dictionary Formation via Reinforcement Learning

Gian Alix, Arian Haghparast, Manos Papagelis

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15893 2024-11-26 cs.LG cs.AI 62%

Distribution-aware Online Continual Learning for Urban Spatio-Temporal Forecasting

Chengxin Wang, Gary Tan, Swagato Barman Roy, Beng Chin Ooi

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07404 2024-11-26 cs.AI cs.LG 62%

Fostering Intrinsic Motivation in Reinforcement Learning with Pretrained Foundation Models

Alain Andres, Javier Del Ser

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted at the Intrinsically Motivated Open-ended Learning workshop at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18737 2024-11-26 cs.CV cs.AI cs.LG cs.RO 62%

MemFusionMap: Working Memory Fusion for Online Vectorized HD Map Construction

Jingyu Song, Xudong Chen, Liupei Lu, Jie Li, Katherine A. Skinner

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI、cs.LG

Comments Accepted to WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07333 2024-11-18 cs.LG cs.AI stat.ML 62%

Mitigating Partial Observability in Sequential Decision Processes via the Lambda Discrepancy

Cameron Allen, Aaron Kirtland, Ruo Yu Tao, Sam Lobel, Daniel Scott, Nicholas Petrocelli, Omer Gottesman, Ronald Parr, Michael L. Littman, George Konidaris

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments GitHub URL: https://github.com/brownirl/lambda_discrepancy; Project page: https://lambda-discrepancy.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07765 2024-11-08 cs.SE cs.AI cs.CY 62%

Using AI-Based Coding Assistants in Practice: State of Affairs, Perceptions, and Ways Forward

Agnia Sergeyuk, Yaroslav Golubev, Timofey Bryksin, Iftekhar Ahmed

专题命中 记忆与上下文管理 :workflow(abstract);分类 cs.AI、cs.SE

Comments Published in Information and Software Technology. 32 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19860 2024-11-06 cs.LG cs.AI 62%

Anomalous State Sequence Modeling to Enhance Safety in Reinforcement Learning

Leen Kweider, Maissa Abou Kassem, Ubai Sandouk

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Journal ref IEEE Access, vol. 12, pp. 157140-157148, Oct. 25, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01396 2024-11-05 cs.LG cs.AI cs.RO 62%

Exploring the Edges of Latent State Clusters for Goal-Conditioned Reinforcement Learning

Yuanlin Duan, Guofeng Cui, He Zhu

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments NeurIPS2024 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01142 2024-11-05 cs.DC cs.AI cs.LG 62%

NEO: Saving GPU Memory Crisis with CPU Offloading for Online LLM Inference

Xuanlin Jiang, Yang Zhou, Shiyi Cao, Ion Stoica, Minlan Yu

专题命中 记忆与上下文管理 :autonomous agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00588 2024-11-04 cs.LG cs.AI 62%

$α$-TCVAE: On the relationship between Disentanglement and Diversity

Cristian Meo, Louis Mahon, Anirudh Goyal, Justin Dauwels

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19400 2024-11-04 cs.LG cs.AI 62%

Offline Reinforcement Learning with OOD State Correction and OOD Action Suppression

Yixiu Mao, Qi Wang, Chen Chen, Yun Qu, Xiangyang Ji

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20005 2024-10-29 cs.LG cs.AI cs.OS cs.SY eess.SY 62%

Enhancing Battery Storage Energy Arbitrage with Deep Reinforcement Learning and Time-Series Forecasting

Manuel Sage, Joshua Campbell, Yaoyao Fiona Zhao

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted for publication at the 18th ASME International Conference on Energy Sustainability

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00330 2024-10-28 cs.LG cs.AI 62%

Two-Step Offline Preference-Based Reinforcement Learning with Constrained Actions

Yinglun Xu, Tarun Suresh, Rohan Gumaste, David Zhu, Ruirui Li, Zhengyang Wang, Haoming Jiang, Xianfeng Tang, Qingyu Yin, Monica Xiao Cheng, Qi Zeng, Chao Zhang, Gagandeep Singh

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16670 2024-10-23 cs.LG cs.AI 62%

CoPS: Empowering LLM Agents with Provable Cross-Task Experience Sharing

Chen Yang, Chenyang Zhao, Quanquan Gu, Dongruo Zhou

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments 25 pages, 5 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12983 2024-10-18 cs.LG cs.AI 62%

Reinforcement Learning with Euclidean Data Augmentation for State-Based Continuous Control

Jinzhu Luo, Dingyang Chen, Qi Zhang

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00385 2024-10-16 cs.LG cs.AI cs.DB 62%

STGformer: Efficient Spatiotemporal Graph Transformer for Traffic Forecasting

Hongjun Wang, Jiyuan Chen, Tong Pan, Zheng Dong, Lingyu Zhang, Renhe Jiang, Xuan Song

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03360 2024-10-15 cs.LG cs.AI 62%

Prioritize Alignment in Dataset Distillation

Zekai Li, Ziyao Guo, Wangbo Zhao, Tianle Zhang, Zhi-Qi Cheng, Samir Khaki, Kaipeng Zhang, Ahmad Sajedi, Konstantinos N Plataniotis, Kai Wang, Yang You

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

Comments 19 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.20222 2024-10-14 cs.CL cs.AI 62%

Beyond Prompts: Dynamic Conversational Benchmarking of Large Language Models

David Castillo-Bolado, Joseph Davidson, Finlay Gray, Marek Rosa

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

Comments Accepted as a poster at NeurIPS D&B Track 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13009 2024-10-11 cs.CL cs.AI 62%

MetaReflection: Learning Instructions for Language Agents using Past Reflections

Priyanshu Gupta, Shashank Kirtania, Ananya Singha, Sumit Gulwani, Arjun Radhakrishna, Sherry Shi, Gustavo Soares

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

Comments We release our experimental code at: https://aka.ms/metareflection-code

详情

展开后加载摘要…

URL PDF HTML 收藏