arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-24 至 2026-03-24 共收录 245 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 23 篇

2603.20613 2026-03-24 cs.HC 50%

A 4R-supported circular product-service system for luxury branded events

一种支持4R的圆形产品-服务系统用于奢侈品牌活动

Ke Ma, Francesca Valsecchi, Yuchen Tan, Mingjia Ji, Junru Shen, Xiaoya Ma, Duan Wu, Jiao Mo, Shijian Zhao

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一种基于4R框架的圆形产品-服务系统,通过可重复使用和可追溯的物理触点与数字协调相结合,优化奢侈品牌活动的材料循环利用,实现可持续的采购和仓储流程。

Comments 19 pages, 11 figures, accepted to be published in the Proceedings of DRS 2026 (Design Research Society Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18415 2026-03-24 cs.HC 50%

AI-Wrapped: Participatory, Privacy-Preserving Measurement of Longitudinal LLM Use In-the-Wild

AI-Wrapped:参与式、隐私保护的长期LLM使用情况实地测量

Cathy Mengying Fang, Sheer Karny, Chayapatr Archiwaranguprok, Yasith Samaradivakara, Pat Pataranutaporn, Pattie Maes

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出AI-Wrapped系统,通过隐私保护的方式收集真实LLM聊天使用数据,并分析用户使用模式及主题,揭示用户在日常场景中对LLM的使用特点及潜在问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20560 2026-03-24 cs.HC cs.GR 50%

Nevis Digital Twin: Photogrammetry and Immersive Visualization of Historical Sites

Nevis数字孪生:历史遗址的摄影测量与沉浸式可视化

Alex Apffel, Huy Tran, Vuthea Chheang

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种多模态数据采集流程,用于保护受威胁的历史遗址,通过摄影测量和3D高斯点散布实现虚拟重建,以提供可扩展的数字遗产民主化模型。

Comments ARCHERIX Workshop - IEEE VR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20382 2026-03-24 cs.CV 50%

Uni-Classifier: Leveraging Video Diffusion Priors for Universal Guidance Classifier

Uni-Classifier: 利用视频扩散先验进行通用引导分类器

Yujie Zhou, Pengyang Ling, Jiazi Bu, Bingjie Gao, Li Niu

机构 * Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出Uni-Classifier,通过利用视频扩散先验引导前序模型的去噪过程,提升生成质量,适用于视频和3D生成任务。

Comments Accepted by ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 7 篇

2602.10218 2026-03-24 cs.AR cs.LG 79%

ACE-RTL: When Agentic Context Evolution Meets RTL-Specialized LLMs

ACE-RTL:当代理上下文进化与专为RTL设计的LLM相遇

Chenhui Deng, Zhongzhi Yu, Guan-Ting Liu, Nathaniel Pinckney, Brucek Khailany, Haoxing Ren

专题命中 软件智能体 :agentic(title,abstract);分类 cs.LG

AI总结 ACE-RTL结合代理上下文进化与专为RTL设计的LLM,通过生成器、反射器和协调器三部分提升RTL代码的正确性,实现41.02%的通过率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21178 2026-03-24 cs.SE cs.AI 73%

LLM-based Automated Architecture View Generation: Where Are We Now?

基于LLM的自动架构视图生成:我们目前处于什么位置?

Miryala Sathvika, Rudra Dhar, Karthik Vaidhyanathan

机构 * Software Engineering Research Centre(软件工程研究中心) IIIT Hyderabad, India(海得拉巴印度理工学院)

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 研究评估了LLM和代理方法在从源代码生成架构视图的能力,发现提示策略略有提升,定制代理在清晰度和细节水平上表现最佳,但仍存在粒度不匹配问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22184 2026-03-24 cs.LG quant-ph 70%

Revisiting Quantum Code Generation: Where Should Domain Knowledge Live?

重新审视量子代码生成:领域知识应该在哪里居住?

Oscar Novo, Oscar Bastidas-Jossa, Alberto Calvo, Antonio Peris, Carlos Kuchkovsky

机构 * Quantum Computing Research, QCentroid(量子计算研究,QCentroid)

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.LG

AI总结 研究比较了Qiskit代码生成中不同专精策略,发现通用LLM在零样本和检索增强设置下表现更优,结合执行反馈代理可提升性能,表明无需领域微调即可实现更灵活的量子软件开发。

Comments Submitted to Quantum Machine Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21698 2026-03-24 cs.AI 70%

A Blueprint for Self-Evolving Coding Agents in Vehicle Aerodynamic Drag Prediction

车辆气动阻力预测中自演化编码代理的蓝图

Jinhui Ren, Huaiming Li, Yabin Liu, Tao Li, Zhaokun Liu, Yujia Liang, Zengle Ge, Chufan Wu, Xiaomin Yuan, Danyu Liu, Annan Li, Jianmin Wu

机构 * Famou Agent Team(Famou 代理团队) Baidu AI Cloud(百度AI云) IAT AI Team(IAT人工智能团队)

专题命中 软件智能体 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出一种基于合同的自演化编码代理框架,通过约束优化发现可执行的代理管道,提升车辆阻力系数预测的效率与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05848 2026-03-24 cs.CV cs.AI cs.RO 57%

Goal Force: Teaching Video Models To Accomplish Physics-Conditioned Goals

目标力:教视频模型实现物理条件化的目标

Nate Gillman, Yinghua Zhou, Zitian Tang, Evan Luo, Arjan Chakravarthy, Daksh Aggarwal, Michael Freeman, Charles Herrmann, Chen Sun

机构 * Brown University(布朗大学) Cornell University(康奈尔大学)

专题命中 软件智能体 :planning(abstract);分类 cs.AI

AI总结 本文提出Goal Force框架,通过显式力矢量和中间动力学定义目标,使视频模型能零样本泛化到复杂现实场景,实现基于物理的视频生成与规划。

Comments Camera ready version (CVPR 2026). Code and interactive demos at https://goal-force.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20847 2026-03-24 cs.SE 57%

Engineering Pitfalls in AI Coding Tools: An Empirical Study of Bugs in Claude Code, Codex, and Gemini CLI

人工智能编码工具中的工程陷阱:对Claude代码、Codex和Gemini CLI中bug的实证研究

Ruixin Zhang, Wuyang Dai, Hung Viet Pham, Gias Uddin, Jinqiu Yang, Song Wang

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 本文通过分析超过3800个公开报告的bug,揭示了构建AI编码工具中的常见故障模式和工程挑战,发现功能相关bug占比超67%,主要症状包括API错误、终端问题和命令失败。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20702 2026-03-24 cs.NE cs.AI 57%

Decoupling Numerical and Structural Parameters: An Empirical Study on Adaptive Genetic Algorithms via Deep Reinforcement Learning for the Large-Scale TSP

分离数值参数与结构参数:通过深度强化学习对适应性遗传算法进行大规模TSP的实证研究

Hongyu Wang, Yuhan Jing, Yibing Shi, Enjin Zhou, Haotian Zhang, Jialong Shi

机构 * School of Mathematics(数学学院) Statistics(统计学) Xi'an Jiaotong University(西安交通大学) School of Mechanical Engineering(机械工程学院) Frontier Institute of Science(前沿科学研究院) Technology(技术) Xi'an, China(中国西安)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 本文通过双重深度强化学习框架研究适应性遗传算法中数值参数与结构参数对TSP的影响,发现结构参数在防止停滞和逃离局部最优中起关键作用。

Comments 6 pages, 8 figures, Accepted by WCCI-CEC Conference

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 11 篇

2603.22170 2026-03-24 cs.MA 88%

Human-Inspired Pavlovian and Instrumental Learning for Autonomous Agent Navigation

受人类启发的经典条件反射与工具性学习用于自主体导航

Jingfeng Shan, Francesco Guidi, Mehrdad Saeidi, Enrico Testi, Elia Favarelli, Andrea Giorgetti, Davide Dardari, Alberto Zanella, Giorgio Li Pira, Francesca Starita, Anna Guerra

专题命中 GUI与网页智能体 :autonomous agent(title,abstract);agent(title);planning(abstract)

AI总结 本文提出一种融合经典条件反射、工具性MF和工具性MB组件的混合强化学习架构,通过地理参考环境特征塑造内在价值信号,提升自主体在不确定环境中的导航安全性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20351 2026-03-24 cs.CR cs.AI 79%

MANA: Towards Efficient Mobile Ad Detection via Multimodal Agentic UI Navigation

MANA:通过多模态代理UI导航实现高效的移动广告检测

Yizhe Zhao, Yongjian Fu, Zihao Feng, Hao Pan, Yongheng Deng, Yaoxue Zhang, Ju Ren

机构 * Department of Computer Science and Technology(计算机科学与技术系) University of Southern California(南加州大学) Shanghai Jiao Tong University(上海交通大学) State Key Laboratory of Internet Architecture(互联网架构国家重点实验室)

专题命中 GUI与网页智能体 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出MANA框架,通过整合多种信号实现高效移动广告检测,提升准确率和效率,有效识别隐蔽恶意广告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12299 2026-03-24 cs.CL cs.AI 73%

MobileIPL: Enhancing Mobile Agents Thinking Process via Iterative Preference Learning

MobileIPL: 通过迭代偏好学习增强移动代理的思维过程

Kun Huang, Weikai Xu, Yuxuan Liu, Quandong Wang, Pengzhi Gao, Wei Liu, Jian Luan, Bin Wang, Bo An

机构 * Xiaomi Inc.(小米公司) Nanyang Technological University(南洋理工大学) Gaoling School of Artificial Intelligence, Renmin University of China(人民大学人工智能学院)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 本文提出MobileIPL,通过迭代偏好学习构建CoaT树,结合规则奖励和反馈反向传播,提升移动代理在GUI任务中的推理能力与泛化能力。

Comments 9 pages, 8 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20238 2026-03-24 eess.SY cs.IT cs.SY math.IT 67%

Joint Trajectory, RIS, and Computation Offloading Optimization via Decentralized Model-Based PPO in Urban Multi-UAV Mobile Edge Computing

多无人机边缘计算中轨迹、RIS和计算卸载联合优化的去中心化模型基于PPO方法

Liangshun Wu, Jianbo Du, Junsuo Qu

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出去中心化模型基于PPO方法,解决密集城市区域多无人机边缘计算中计算卸载、轨迹和RIS相位配置的联合优化问题,提升吞吐量和能效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20366 2026-03-24 cs.IR cs.AI 57%

WebNavigator: Global Web Navigation via Interaction Graph Retrieval

WebNavigator: 通过交互图检索实现全局网络导航

Xuanwang Zhang, Yuteng Han, Jinnan Qi, Mulong Xie, Zhen Wu, Xinyu Dai

机构 * National Key Laboratory for Novel Software Technology(新型软件技术国家重点实验室) School of Artificial Intelligence(人工智能学院) Fellou AI

专题命中 GUI与网页智能体 :workflow(abstract);分类 cs.AI

AI总结 WebNavigator通过交互图检索和路径规划解决自主网络导航中的拓扑盲区问题,实现优于企业级代理的性能。

Comments 24 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10154 2026-03-24 cs.RO 50%

CompassNav: Steering From Path Imitation To Decision Understanding In Navigation

CompassNav: 从路径模仿到决策理解的导航导航

LinFeng Li, Jian Zhao, Yuan Xie, Xin Tan, Xuelong Li

机构 * East China Normal University(东华师范大学) The Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究所(TeleAI),中国电信) Northwestern Polytechnical University(西北工业大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出CompassNav方法,通过引入Compass-Data-22k数据集和gap-aware奖励函数,使导航代理能理解而非单纯模仿路径,实现更高效的导航性能。

Journal ref Proceedings of the 14th International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21269 2026-03-24 cs.RO 50%

DyGeoVLN: Infusing Dynamic Geometry Foundation Model into Vision-Language Navigation

DyGeoVLN: 将动态几何基础模型注入视觉-语言导航

Xiangchen Liu, Hanghan Zheng, Jeil Jeong, Minsung Yoon, Lin Zhao, Zhide Zhong, Haoang Li, Sung-Eui Yoon

机构 * KAIST(韩国科学技术院) HKUST(GZ)(香港科技大学(广州)) JD Explore Academy(JD探索学院)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出DyGeoVLN框架,通过跨分支特征融合将动态几何基础模型注入视觉-语言导航,实现显式3D空间表示和视觉-语义推理,并引入新的无姿态自适应分辨率令牌剪枝策略以提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20804 2026-03-24 cs.CV cs.RO 50%

Does Peer Observation Help? Vision-Sharing Collaboration for Vision-Language Navigation

同伴观察有助于吗?面向视觉语言导航的视觉共享协作

Qunchao Jin, Yiliao Song, Qi Wu

机构 * Australian Institute for Machine Learning(澳大利亚机器学习研究所) Adelaide University(阿德莱德大学) Responsible AI Research Centre(负责任人工智能研究中心)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出Co-VLN框架,研究同伴观察对视觉语言导航的影响,通过共享感知记忆扩展接收场,验证了在R2R基准下两种方法中性能的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20625 2026-03-24 cs.NI 50%

Immersive Volumetric Video Playback: Near-RT Resource Allocation and O-RAN-based Implementation

沉浸式体积极限视频回放:近实时资源分配与O-RAN-based实现

Yao Wen, Luping Xiang, Kun Yang

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出基于O-RAN的沉浸式体积极限视频回放框架,通过近实时控制循环联合优化无线电、计算和内容资源,降低运动到光子延迟,提升用户体验。

Comments Accepted to TMC, IEEE Transactions on Mobile Computing. https://doi.org/10.1109/TMC.2026.3674975

Journal ref IEEE Transactions on Mobile Computing (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08935 2026-03-24 cs.RO cs.CV 50%

Expand Your SCOPE: Semantic Cognition over Potential-Based Exploration for Embodied Visual Navigation

拓展你的SCOPE:基于潜在探索的语义认知用于具身视觉导航

Ningnan Wang, Weihuang Chen, Liming Chen, Haoxuan Ji, Zhongyu Guo, Xuchong Zhang, Hongbin Sun

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出SCOPE框架,通过利用前沿信息驱动潜在探索,提升具身视觉导航中的决策质量与目标相关性,实验表明其在准确性和泛化能力上优于现有方法。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17340 2026-03-24 cs.RO cs.SY eess.SY 50%

AERO-MPPI: Anchor-Guided Ensemble Trajectory Optimization for Agile Mapless Drone Navigation

AERO-MPPI:基于锚点的轨迹优化用于无地图无人机敏捷导航

Xin Chen, Rui Huang, Longbin Tang, Lin Zhao

机构 * Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出AERO-MPPI框架,通过GPU加速统一感知与规划,利用多分辨率LiDAR点云提取锚点,构建多项式轨迹引导,提升无人机在复杂环境中的敏捷导航能力。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 12 篇

2603.20357 2026-03-24 cs.CR cs.AI 89%

Memory poisoning and secure multi-agent systems

记忆污染与安全多智能体系统

Vicenç Torra, Maria Bras-Amorós

机构 * Department of Computing Science, Ume University, Ume , Sweden(瑞典乌梅大学计算机科学系) Departament of Mathematics, Universitat Politècnica de Catalunya, Catalonia, Spain(西班牙加泰罗尼亚理工大学数学系)

专题命中 记忆与上下文管理 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 本文探讨了多智能体系统中记忆污染攻击的风险,分析了不同记忆系统类型的安全性,并提出基于密码学的缓解策略,强调了智能体交互中的实际风险及安全设计的重要性。

Comments 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21399 2026-03-24 cs.AI 79%

The Myhill-Nerode Theorem for Bounded Interaction: Canonical Abstractions via Agent-Bounded Indistinguishability

有界交互的Myhill-Nerode定理:通过智能体有界不可区分性获得规范抽象

Anthony T. Nixon

机构 * DefSig

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文研究了有限POMDP中有界交互的规范抽象,通过智能体有界不可区分性定义了规范商,并验证了其在时钟感知探针下的决策充分性及在潜在状态奖励下的近似界限。

Comments 43 pages, 4 figures, 23 tables. Code: https://github.com/alch3mistdev/finite-pomdp-abstraction (v0.1.1)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02064 2026-03-24 q-bio.NC cs.AI 79%

REMI: Reconstructing Episodic Memory During Internally Driven Path Planning

REMI:在内部驱动路径规划中重建情景记忆

Zhaoze Wang, Genela Morris, Dori Derdikman, Pratik Chaudhari, Vijay Balasubramanian

专题命中 记忆与上下文管理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种MEC-HC连接理论,解释了网格细胞和位置细胞如何通过相互作用支持空间编码和内部驱动路径规划,如通过线索导航到记忆中的地点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21278 2026-03-24 cs.CL cs.AI cs.HC 73%

Conversation Tree Architecture: A Structured Framework for Context-Aware Multi-Branch LLM Conversations

对话树架构:一种面向上下文感知多分支LLM对话的结构化框架

Pranav Hemanth, Sampriti Saha

机构 * Pandemonium Research(Pandemonium研究院)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出对话树架构(CTA),通过层次化结构管理LLM对话,解决传统扁平结构导致的上下文污染问题,提供结构化对话上下文管理方法。

Comments 6 pages, 1 figure. Prototype available at https://the-conversation-tree.vercel.app/app

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20939 2026-03-24 cs.CL cs.AI cs.HC cs.IR stat.ML 62%

User Preference Modeling for Conversational LLM Agents: Weak Rewards from Retrieval-Augmented Interaction

用于对话大语言模型代理的用户偏好建模:来自检索增强交互的弱奖励

Yuren Hao, Shuhaib Mehri, ChengXiang Zhai, Dilek Hakkani-Tür

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出VARS框架,通过长短期向量表示用户偏好,利用弱奖励在线更新向量,提升交互效率,实验证明其在多会话协作任务中表现优异。

Comments 21 pages including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20604 2026-03-24 cs.LG cs.GT 57%

Bayesian Learning in Episodic Zero-Sum Games

博弈中贝叶斯学习

Chang-Wei Yueh, Andy Zhao, Ashutosh Nayyar, Rahul Jain

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文研究了在未知转移和奖励模型的有限时间零和马尔可夫游戏中,贝叶斯学习的后验算法,分析了两种设置下的预期遗憾界,并在网格世界捕食者-猎物域中验证了后验采样算法的子线性遗憾性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15586 2026-03-24 cs.AI cs.SY eess.SY 57%

Computational Concept of the Psyche

心理的计算概念

Anton Kolonin, Vladimir Krykov

机构 * Novosibirsk State University(新西伯利亚国立大学) Aigents(Aigents公司) SingularityNET Foundation(SingularityNET基金会) Domodedovo Business Partner(多莫德沃夫商务伙伴)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出了一种认知架构概念,将心理视为智能体的操作系统,通过经验学习在包含需求的状态空间中构建通用人工智能系统。

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10744 2026-03-24 cs.AI cs.CV 57%

Explore with Long-term Memory: A Benchmark and Multimodal LLM-based Reinforcement Learning Framework for Embodied Exploration

探索与长期记忆:一个基准和基于多模态LLM的强化学习框架用于具身探索

Sen Wang, Bangwei Liu, Zhenkun Gao, Lizhuang Ma, Xuhong Wang, Yuan Xie, Xin Tan

机构 * East China Normal University(东华大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出LMEE框架,通过多模态LLM强化学习促进终身学习,构建LMEE-Bench基准评估具身探索过程与结果,采用MemoryExplorer方法提升记忆检索与主动探索能力。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏