arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-05-13 至 2026-05-13 共收录 191 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 34 篇

2605.11807 2026-05-13 cs.AI 57%

Why Users Go There: World Knowledge-Augmented Generative Next POI Recommendation

为何用户前往那里:世界知识增强的生成性下一个兴趣点推荐

Qiuyu Ding, Heng-Da Xu, Wei Zhang, Dongyi Lv, Changda Xia, Feng Xiong, Mu Xu

机构 * Amap, Alibaba Group(阿里巴巴集团阿地图) Xi’an Jiaotong University(西安交通大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出AWARE模型,通过LLM代理生成时空感知的上下文叙述,结合用户行为增强世界知识,提升POI推荐效果,实验证明其优于基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11363 2026-05-13 cs.CV cs.CL 57%

PresentAgent-2: Towards Generalist Multimodal Presentation Agents

PresentAgent-2: 向通用多模态展示代理迈进

Wei Wu, Ziyang Xu, Zeyu Zhang, Yang Zhao, Hao Tang

机构 * Peking University(北京大学) La Trobe University(拉特罗布大学)

专题命中 Agent评测 :agentic(abstract);分类 cs.CL

AI总结 PresentAgent-2通过多模态资源收集与生成,实现基于用户查询的交互式展示视频生成,支持单人叙述、多人讨论及观众互动三种模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11036 2026-05-13 cs.CR cs.AI 57%

Sequential Behavioral Watermarking for LLM Agents

序列行为水印用于LLM代理

Hyeseon An, Shinwoo Park, Dongsu Kim, Yo-Sub Han

机构 * Department of Computer Science(计算机科学系)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出SeqWM,通过在历史条件下的转移模式中嵌入信号,实现对代理轨迹的无位置验证,提升水印鲁棒性与检测可靠性。

Comments 17 pages, 3 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11026 2026-05-13 cs.CR cs.CL 57%

AgentShield: Deception-based Compromise Detection for Tool-using LLM Agents

AgentShield:基于欺骗的工具使用LLM代理 compromise 检测

Yassin H. Rassul, Tarik A. Rashid

机构 * Computer Science and Engineering Department, School of Science and Engineering, University of Kurdistan Hewl\^{e}r, Erbil, Iraq(科罗曼嫩大学科学与工程学院计算机科学与工程系) Engineering Department, School of Science(科学学院工程系) Engineering, University of Kurdistan Hewl\ e r, Erbil, Iraq(科罗曼嫩大学工程学院) Innovation Centre, University of Kurdistan Hewl\ e r, Erbil, Iraq(科罗曼嫩大学创新中心)

专题命中 Agent评测 :agent(abstract);分类 cs.CL

AI总结 AgentShield 通过在代理工具接口中设置三层陷阱(假工具、假凭证、允许参数)来检测间接提示注入攻击,利用高精度标签训练自监督分类器,实现高准确率的实时检测与无误报的下游检测训练。

Comments 20 pages, 5 figures. Code: https://github.com/Yassin-H-Rassul/AgentShield

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07782 2026-05-13 cs.CL cs.PL 57%

CktFormalizer: Autoformalization of Natural Language into Circuit Representations

CktFormalizer: 自然语言到电路表示的自动形式化

Jing Xiong, Qi Han, Chenchen Ding, He Xiao, Zunhai Su, Chaofan Tao, Ngai Wong

机构 * The University of Hong Kong(香港大学)

专题命中 Agent评测 :agent(abstract);分类 cs.CL

AI总结 CktFormalizer通过依赖类型HDL在Lean 4中实现LLM生成硬件描述的自动形式化,解决Verilog中的宽度不匹配、组合环和不完整案例逻辑问题,提升后端实现率和仿真通过率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01682 2026-05-13 cs.LG cs.DS stat.ML 57%

Finite and Corruption-Robust Regret Bounds in Online Inverse Linear Optimization under M-Convex Action Sets

有限的和抗腐败的在线逆线性优化在M-凸行动集下的后悔界

Taihei Oki, Shinsaku Sakaue

机构 * Institute for Chemical Reaction Design and Discovery (ICReDD), Hokkaido University(化学反应设计与发现研究所(ICReDD),北海道大学) D3 Center, The University of Osaka(大阪大学D3中心) Center for Advanced Intelligence Project, RIKEN(先进智能项目中心,RIKEN) CyberAgent, Tokyo, Japan(CyberAgent,日本东京) National Institute of Informatics, Tokyo, Japan(信息技术国家研究所,日本东京)

专题命中 Agent评测 :agent(abstract);分类 cs.LG

AI总结 研究在线逆线性优化问题,提出在M-凸可行集下可实现O(d log d)的有限后悔界,并扩展到对抗性腐败反馈场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12237 2026-05-13 cs.CV 50%

UHR-Micro: Diagnosing and Mitigating the Resolution Illusion in Earth Observation VLMs

UHR-Micro: 诊断和缓解地球观测VLMs中的分辨率错觉

Shuo Ni, Tong Wang, Jing Zhang, He Chen, Haonan Guo, Ning Zhang, Bo Du

机构 * National Key Laboratory of Science and Technology on Space-Born Intelligent Information Processing(国家空间智能信息处理科技重点实验室) Beijing Institute of Technology(北京理工大学) School of Computer Science(计算机学院) Wuhan University(武汉大学) Zhongguancun Academy(中关村学院) State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing(测绘遥感信息工程国家重点实验室) Hong Kong Polytechnic University(香港理工大学)

专题命中 Agent评测 :agent(abstract)

AI总结 UHR-Micro通过11253条指令和1212张超高清图像,评估VLM在高分辨率地球观测图像中的空间极限表现,揭示高分辨率输入下空间定位和证据解析的失败,并提出MAP代理以证据为中心提升微尺度感知。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09965 2026-05-13 cs.CV 50%

Towards Generalist Game Players: An Investigation of Foundation Models in the Game Multiverse

迈向通用游戏玩家:对游戏多元宇宙中基础模型的调查

Kuan Zhang, Dongchen Liu, Qiyue Zhao, Tianyu Xin, Yue Su, Haisheng Wang, Han Yin, Hongbo Ma, Peize Li, Tianjun Gu, Xiangnan Wu, Xinran Zhang, Yongxuan Li, Zirong Chen, Yiming Li

机构 * College of AI, Tsinghua University(清华大学人工智能学院) MMLab, The University of Hong Kong(香港大学MMLab) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 Agent评测 :agent(abstract)

AI总结 本文探讨了在游戏多元宇宙中训练通用游戏玩家的基础模型,分析了数据集、模型、工具和基准四个支柱,并提出五阶段路线图,旨在实现能够同时创造和演化游戏世界的通用智能体。

Comments 51 pages, 7 figures, github: https://github.com/THUSI-Lab/Awesome-LFMs-Play-Games

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24869 2026-05-13 cs.NI cs.SY eess.SY 50%

Deep Reinforcement Learning Approach to QoSAware Load Balancing in 5G Cellular Networks under User Mobility and Observation Uncertainty

基于深度强化学习的5G蜂窝网络中考虑服务质量的负载均衡方法

Mehrshad Eskandarpour, Hossein Soleimani

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出基于PPO的深度强化学习框架,用于在用户移动性和观测不确定性下实现端到端的QoS感知负载均衡,通过多目标奖励机制平衡效率与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01976 2026-05-13 cs.GT 50%

Learning a Game by Paying the Agents

通过支付代理人学习游戏

Brian Hu Zhang, Tao Lin, Yiling Chen, Tuomas Sandholm

专题命中 Agent评测 :agent(abstract)

AI总结 研究在重复正常形式游戏中学习无遗憾学习代理的效用函数问题,提出通过支付函数学习所有代理效用函数的方法,为引导代理到均衡提供新算法。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他Agent 1 篇

2509.06701 2026-05-13 cs.LG cs.AI 81%

Probabilistic Modeling of Latent Agentic Substructures in Deep Neural Networks

深度神经网络中潜在代理子结构的概率建模

Su Hyeong Lee, Risi Kondor, Richard Ngo

机构 * Department of Statistics, University of Chicago(芝加哥大学统计学系) Department of Computer Science, University of Chicago(芝加哥大学计算机科学系)

专题命中 其他Agent :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于概率建模的智能代理理论,探讨了代理通过加权对数池化实现递归结构,并揭示了在LLM中代理对齐现象的数学框架。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏