arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-23 至 2026-04-23 共收录 159 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 20 篇

2604.15319 2026-04-23 cs.HC cs.AI 79%

Explainable Iterative Data Visualisation Refinement via an LLM Agent

通过LLM代理的可解释迭代数据可视化细化

Burak Susam, Tingting Mu

机构 * Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系)

专题命中 工作流自动化 :agent(title);agentic(abstract);分类 cs.AI

AI总结 本文提出利用LLM代理的自动化方法,通过结合定量评估与人类洞察,实现高维数据可视化优化,生成高质量可视化结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16914 2026-04-23 cs.CV eess.IV 78%

Unified Ultrasound Intelligence Toward an End-to-End Agentic System

统一超声智能:面向端到端代理系统

Chen Ma, Yunshu Li, Junhu Fu, Shuyu Liang, Yuanyuan Wang, Yi Guo

机构 * College of Biomedical Engineering, Fudan University, Shanghai, China(复旦大学生物医学工程学院,上海,中国)

专题命中 工作流自动化 :agentic(title);workflow(abstract)

AI总结 本文提出USTri框架,通过三阶段方法实现多器官多任务统一分析,提升跨设备和协议的泛化能力,生成可解释的临床报告。

Comments Accepted by ISBI2026. 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22525 2026-04-23 cs.CR 78%

Systems-Level Attack Surface of Edge Agent Deployments on IoT

边缘代理在物联网上的系统级攻击面

Zhonghao Zhan, Krinos Li, Yefan Zhang, Hamed Haddadi

专题命中 工作流自动化 :agent(title,abstract)

AI总结 研究分析了三种物联网边缘代理部署架构的系统级攻击面,发现边缘部署虽减少云数据暴露,但 fallback 机制会削弱主权,且溯源链易被绕过。

Comments Proceedings of the 6th Workshop on Machine Learning and Systems (EuroMLSys '26), co-located with EuroSys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19833 2026-04-23 econ.EM cs.CY physics.ao-ph 71%

From Clerks to Agentic-AI: How will Technology Change Labor Market in Finance?

从职员到代理型AI:技术如何改变金融领域的劳动力市场?

Lu Yu, Xiang Li

专题命中 工作流自动化 :agentic(title)

AI总结 本文通过跟踪金融公司资产规模与员工比的变化,探讨技术进步对金融行业劳动力需求的影响,分析不同技术浪潮下资产管理和运营成本的变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09958 2026-04-23 cs.CL cs.LG 62%

Neural Bandit Based Optimal LLM Selection for a Pipeline of Subtasks

基于神经带宽的最优LLM选择用于子任务流水线

Baran Atalar, Eddie Zhang, Carlee Joe-Wong

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 工作流自动化 :agentic(abstract);分类 cs.CL、cs.LG

AI总结 本文提出一种神经上下文带宽算法,用于在无需历史LLM性能数据的情况下,指导不同子任务的LLM选择,通过子任务输出影响后续任务,实现子任务间复杂依赖关系的学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20055 2026-04-23 cs.AI cs.HC 57%

From Fuzzy to Formal: Scaling Hospital Quality Improvement with AI

从模糊到正式:利用AI扩展医院质量改进

Patrick Vossler, Jean Feng, Venkat Sivaraman, Robert Gallo, Hemal Kanzaria, Dana Freiser, Christopher Ross, Amy Ou, James Marks, Susan Ehrlich, Christopher Peabody, Lucas Zier

机构 * University of California, San Francisco(加州大学旧金山分校) Zuckerberg San Francisco General Hospital(扎克伯格旧金山总医院)

专题命中 工作流自动化 :AI agent(abstract);分类 cs.AI

AI总结 本文提出通过AI框架优化医院质量改进过程,通过学习LLM提示和自然语言规范,提升质量因素发现的效率与可追溯性,实现人类与AI协同优化。

Comments 34 pages, 8 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19367 2026-04-23 cs.CV cs.AI 57%

AnatomicalNets: A Multi-Structure Segmentation and Contour-Based Distance Estimation Pipeline for Clinically Grounded Lung Cancer T-Staging

AnatomicalNets:一种用于临床肺癌T分期的多结构分割和基于轮廓的距离估计流程

Saniah Kayenat Chowdhury, Rusab Sarmun, Muhammad E. H. Chowdhury, Sohaib Bassam Zoghoul, Israa Al-Hashimi, Adam Mushtak, Amith Khandakar

机构 * Department of Robotics and Mechatronics Engineering, University of Dhaka(达卡大学机器人与机电工程系) Department of Electrical and Electronics Engineering, University of Dhaka(达卡大学电气与电子工程系) Department of Electrical Engineering, Qatar University(卡塔尔大学电气工程系) Department of Radiology, Hamad Medical Corporation(哈马德医疗集团放射科) Department of Biomedical Technology, Prince Sattam Bin Abdulaziz University(普林斯·萨塔姆·本·阿卜杜勒阿齐兹大学生物医学技术系)

专题命中 工作流自动化 :planning(abstract);分类 cs.AI

AI总结 本文提出AnatomicalNets,通过多阶段流程将肿瘤分期转化为测量和规则推理问题,利用三个编码器-解码器网络进行分割,并结合轮廓距离估计方法提升临床可解释性,实现91.36%的分类准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14536 2026-04-23 cs.LG 57%

How Will My Business Process Unfold? Predicting Case Suffixes With Start and End Timestamps

我的业务流程将如何展开?通过起始和结束时间戳预测案例后缀

Muhammad Awais Ali, Marlon Dumas, Fredrik Milani

机构 * University of Tartu(塔尔图大学)

专题命中 工作流自动化 :planning(abstract);分类 cs.LG

AI总结 本文提出通过起始和结束时间戳预测业务流程后缀的方法,以更精确地预测资源需求,解决传统方法仅能预测单一时间戳的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20230 2026-04-23 cond-mat.mtrl-sci 50%

Crystal structure prediction with nuclear quantum and finite-temperature effects via deep free energy learning

通过深度自由能学习进行考虑核量子和有限温度效应的晶体结构预测

Xiaoyang Wang, Yinan Wang, Wenbo Zhao, Hanyu Liu, Hao Xie, Lei Wang, Han Wang

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出通过深度自由能模型在高通量晶体结构预测中整合有限温度和核量子效应,通过两阶段学习流程实现自由能、力和应力的单次前向传递,成功预测了La-Sc-H系统中新的稳定笼状氢化物。

Comments 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19814 2026-04-23 quant-ph cs.ET 50%

Quantum Integrated High-Performance Computing: Foundations, Architectural Elements and Future Directions

量子集成高性能计算:基础、架构要素与未来方向

Suman Raj, Siva Sai, Yogesh Simmhan, Kyle Chard, Rajkumar Buyya

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出量子集成高性能计算框架,整合CPU、GPU、FPGA和量子处理器,通过统一资源管理与混合工作流编排,实现经典与量子计算的无缝协作,面向量子化学、材料发现等新兴领域。

Comments 30 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23089 2026-04-23 cs.CV 50%

A Synchronized Audio-Visual Multi-View Capture System

同步的音频-视觉多视角捕捉系统

Xiangwei Shi, Gara Dorta, Ruud de Jong, Ojas Shirekar, Chirag Raman

机构 * Delft University of Technology(代尔夫特理工大学)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一种同步音频-视觉多视角捕捉系统,通过统一时间架构整合多摄像机和多通道麦克风,实现高质量的音频视频同步记录,支持对话行为的精细分析与建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12299 2026-04-23 cs.DC 50%

A Conflict-Aware Resource Management Framework for the Computing Continuum

面向计算连续体的冲突感知资源管理框架

Vlad Popescu-Vifor, Ilir Murturi, Praveen Kumar Donta, Schahram Dustdar

专题命中 工作流自动化 :agent(abstract)

AI总结 本文提出基于深度强化学习的冲突解决框架,用于优化计算连续体中资源调度,解决资源冲突和提升服务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20640 2026-04-23 astro-ph.IM 50%

A Python/CuPy Software Correlator for QUEST: Real-Time Performance and Initial Imaging

为QUEST设计的Python/CuPy软件相关器:实时性能和初步成像

Jialang Ding, Guanhong Lin, Dejia Zhou, Jianli Zhang, Ran Duan, Fei Liu, Xiaoyun Ma, Jie Zhang, Meng Liu, Chenchen Miao, Yuan Liang, Liaoyuan Liu, Yingrou Zhan, Yuting Chu, Jing Qiao, Wei Wang, Zerui Wang, Menquan Liu, Meng Guo, Di Li, Pei Wang, Xuanyu Wang, Xiaohui Yan

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文介绍一种用于小型射电干涉阵列的Python/CuPy软件相关器,评估其在QUEST上的实时性能和初步成像能力,采用多线程数据采集、GPU加速相关运算等技术,实现四天线模式下的高吞吐量和高质量成像。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20542 2026-04-23 cond-mat.mes-hall 50%

Memristive Switches in Rigid Conjugated Single-Molecule Junctions

刚性共轭单分子接头中的忆阻开关

Riccardo Conte, Lucienne van der Geest, Minu Sheeja, Przemyslaw Gawel, Cina Foroutan-Nejad, Herre S. J. van der Zant

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究了三种无明显内部开关路径的刚性OPE衍生物,发现低温下具有非易失、双稳态滞后I-V特性,提出定量分析方法区分忆阻I-V特性并提取开关特征。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 11 篇

2604.20779 2026-04-23 cs.AI cs.CY cs.SE 84%

SWE-chat: Coding Agent Interactions From Real Users in the Wild

SWE-chat:从真实用户中编码代理交互

Joachim Baumann, Vishakh Padmakumar, Xiang Li, John Yang, Diyi Yang, Sanmi Koyejo

机构 * Stanford University(斯坦福大学)

专题命中 软件智能体 :agent(title,abstract);AI agent(abstract);分类 cs.AI、cs.SE

AI总结 SWE-chat是首个大规模真实编码代理会话数据集,包含6000个会话,揭示了编码代理在真实场景中的使用模式和失败模式,发现代理生成的代码效率低下且存在更多安全漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03690 2026-04-23 cs.SE cs.AI 81%

The OpenHands Software Agent SDK: A Composable and Extensible Foundation for Production Agents

OpenHands软件代理SDK:一种可组合且可扩展的生产代理基础

Xingyao Wang, Simon Rosenberg, Juan Michelini, Calvin Smith, Hoang Tran, Engel Nyst, Rohit Malhotra, Xuhui Zhou, Valerie Chen, Robert Brennan, Graham Neubig

机构 * MLSys 2026

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 本文提出OpenHands SDK,提供灵活的代理实现接口、安全可靠执行及用户交互接口,整合了本地到远程执行、多LLM路由和安全分析,验证了其在生产部署中的有效性。

Comments Accepted at MLSys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03335 2026-04-23 cs.LG 79%

EvolveSignal: A Large Language Model Powered Coding Agent for Discovering Traffic Signal Control Strategies

EvolveSignal:一种基于大语言模型的编程代理,用于发现交通信号控制策略

Leizhen Wang, Peibo Duan, Hao Wang, Yue Wang, Jian Xu, Nan Zheng, Zhenliang Ma

机构 * Department of Data Science and Artificial Intelligence, Monash University(数据科学与人工智能系,墨尔本大学) School of Transportation, Southeast University(交通学院,东南大学) Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院) Department of Civil and Environmental Engineering, Monash University(土木与环境工程系,墨尔本大学) Department of Civil and Architectural Engineering, KTH Royal Institute of Technology(土木与建筑工程系,皇家理工学院)

专题命中 软件智能体 :agent(title,abstract);分类 cs.LG

AI总结 本文提出EvolveSignal,利用大语言模型自动发现可解释的启发式策略,通过程序合成方法优化交通信号控制,实验表明其在减少延误和停车次数方面优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07849 2026-04-23 cs.SE cs.AI cs.IR 73%

SweRank: Software Issue Localization with Code Ranking

SweRank: 代码排名用于软件问题定位

Revanth Gangi Reddy, Tarun Suresh, JaeHyeok Doo, Ye Liu, Xuan Phi Nguyen, Yingbo Zhou, Semih Yavuz, Caiming Xiong, Heng Ji, Shafiq Joty

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Salesforce Research(Salesforce 研究) KAIST AI(韩国科学技术院人工智能研究所)

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文提出SweRank框架,通过高效的检索与重排序方法提升软件问题定位的准确性,实验表明其在SWE-Bench-Lite和LocBench上优于现有方法。

Comments ICLR 2026 Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20067 2026-04-23 q-fin.TR 71%

Testing replication for an agent-based model of market fragmentation and latency arbitrage

对代理基于市场碎片化和延迟套利模型的复制性检验

Ethan Ratliff-Crain, Colin M. Van Oort, Matthew T. K. Koehler, Brian F. Tivnan

专题命中 软件智能体 :agent(title)

AI总结 本文通过复制Wah和Wellman 2016年的延迟套利模型,发现原论文中缺失的实现细节和有限的定量报告阻碍了准确复制。通过增加模拟次数生成置信区间,弥补了分布信息的不足,并指出模型复杂性与对齐难度成正比。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03362 2026-04-23 cs.SE 70%

ABTest: Behavior-Driven Testing for AI Coding Agents

ABTest:面向AI编码代理的行为驱动测试

Wuyang Dai, Moses Openja, Hung Viet Pham, Gias Uddin, Jinqiu Yang, Song Wang

专题命中 软件智能体 :agent(abstract);workflow(abstract);分类 cs.SE

AI总结 本文提出ABTest框架,通过挖掘用户报告的异常生成可执行测试用例,发现AI编码代理在真实场景中的鲁棒性差异及新故障模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20398 2026-04-23 cs.CL cs.LG cs.SE 67%

WebGen-R1: Incentivizing Large Language Models to Generate Functional and Aesthetic Websites with Reinforcement Learning

WebGen-R1: 通过强化学习激励大语言模型生成功能性和美观的网站

Juyong Jiang, Chenglin Cai, Chansung Park, Jiasi Shen, Sunghun Kim, Jianguo Li, Yue Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学) Tongyi Lab, Alibaba Group(阿里云实验室) Electronics and Telecommunications Research Institute(电子电信研究院) Ant Group(蚂蚁集团)

专题命中 软件智能体 :agentic(abstract);分类 cs.CL、cs.LG、cs.SE

AI总结 本文提出WebGen-R1框架,通过强化学习生成多页面功能性和美观的网站,解决了传统方法在多页面交互和审美评估上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19825 2026-04-23 cs.SE cs.AI 62%

SolidCoder: Bridging the Mental-Reality Gap in LLM Code Generation through Concrete Execution

SolidCoder:通过具体执行弥合LLM代码生成中的心理现实差距

Woojin Lee, Jin-Xia Huang

机构 * Electronics and Telecommunications Research Institute, Republic of Korea(韩国电信研究所)

专题命中 软件智能体 :planning(abstract);分类 cs.AI、cs.SE

AI总结 SolidCoder通过强制边缘情况意识和沙盒执行解决心理现实差距,提升代码生成性能,实现HumanEval、CodeContests和APPS的高准确率。

Comments 23 pages, 2 figures, Accepted at Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20452 2026-04-23 cs.IR cs.CL 57%

HaS: Accelerating RAG through Homology-Aware Speculative Retrieval

HaS:通过同源感知的推测检索加速RAG

Peng Peng, Weiwei Lin, Wentai Wu, Xinyang Wang, Yongheng Liu

机构 * South China University of Technology(华南理工大学) Pengcheng Laboratory(鹏城实验室) Jinan University(暨南大学) Beijing Forestry University(北京林业大学)

专题命中 软件智能体 :agentic(abstract);分类 cs.CL

AI总结 HaS通过同源感知的推测检索框架,在受限范围内进行低延迟推测检索以获取候选文档,并验证其是否包含所需知识,从而提升RAG的效率。

Comments Accepted by ICDE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19965 2026-04-23 cs.SE 57%

Insights into Security-Related AI-Generated Pull Requests

对与安全相关的AI生成拉取请求的洞察

Md Fazle Rabbi, Asif K. Turzo, Arifa I. Champa, Minhaz F. Zibran

专题命中 软件智能体 :agentic(abstract);分类 cs.SE

AI总结 本文分析了33,000多个AI生成的拉取请求,发现675个与安全相关的提交,揭示了AI生成的拉取请求中常见的安全漏洞及审查结果,发现提交质量对接受度影响有限,扩展了拒绝分类。

Comments accepted at the International Conference on Evaluation and Assessment in Software Engineering (EASE), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22598 2026-04-23 cs.CL 57%

RExBench: Can coding agents autonomously implement AI research extensions?

RExBench:代码代理能否自主实现AI研究扩展?

Nicholas Edwards, Yukyung Lee, Yujun Audrey Mao, Yulu Qin, Sebastian Schuster, Najoung Kim

机构 * Faculty of Computer Science, University of Vienna(维也纳大学计算机科学系) UniVie Doctoral School Computer Science, University of Vienna(维也纳大学UniVie计算机科学博士学院) Boston University(波士顿大学)

专题命中 软件智能体 :agent(abstract);分类 cs.CL

AI总结 本文提出RExBench基准,评估代码代理自主实现AI研究扩展的能力,发现现有代理在无人类指导时成功率不足44%。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 2 篇

2604.19750 2026-04-23 cs.SE cs.AI cs.HC 73%

Coding with Eyes: Visual Feedback Unlocks Reliable GUI Code Generating and Debugging

通过眼睛编码:视觉反馈解锁可靠的GUI代码生成与调试

Zhilin Liu, Ye Huang, Ting Xie, Ruizhi Zhang, Wen Li, Lixin Duan

机构 * Shenzhen Institute for Advanced Study, University of Electronic Science

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出InteractGUI Bench基准和VF-Coder系统,通过视觉反馈提升GUI代码生成与调试效果,提高成功率和视觉评分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26557 2026-04-23 cs.HC 50%

The Invisible Mentor: Inferring User Actions from Screen Recordings to Recommend Better Workflows

隐形导师:从屏幕记录推断用户行为以推荐更好的工作流程

Litao Yan, Andrew Head, Ken Milne, Vu Le, Sumit Gulwani, Chris Parnin, Emerson Murphy-Hill

专题命中 GUI与网页智能体 :workflow(abstract)

AI总结 本文提出InvisibleMentor系统,通过屏幕记录推断用户行为,推荐更高效的工作流程,优于传统依赖日志或用户提示的助手。

Comments 15 pages, 6 figures

Journal ref Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems (CHI '26), 1-17, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 11 篇

2508.00414 2026-04-23 cs.AI cs.CL 84%

Cognitive Kernel-Pro: A Framework for Deep Research Agents and Agent Foundation Models Training

认知内核-Pro:深度研究代理及代理基础模型训练的框架

Tianqing Fang, Zhisong Zhang, Xiaoyang Wang, Rui Wang, Can Qin, Yuxuan Wan, Jun-Yu Ma, Ce Zhang, Jiaqi Chen, Xiyun Li, Yonglin Wang, Jingchen Ni, Tianshi Zheng, Chun Chen, Wenhao Yu, Zhenwen Liang, Hongming Zhang, Haitao Mi, Dong Yu

机构 * Tencent AI Lab(腾讯人工智能实验室)

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出Cognitive Kernel-Pro框架,旨在通过开放源代码和免费资源促进高级AI代理的开发与评估,重点研究高质量训练数据的构建及代理测试时的反思与投票策略,实现了在GAIA上的领先性能。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13533 2026-04-23 cs.RO cs.CV 82%

Evolvable Embodied Agent for Robotic Manipulation via Long Short-Term Reflection and Optimization

可进化具身代理:通过长期短期反思与优化实现机器人操作

Jianzong Wang, Botao Zhao, Yayun He, Junqing Peng, Xulong Zhang

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司)

专题命中 记忆与上下文管理 :agent(title,abstract);planning(abstract)

AI总结 本文提出EEAgent框架,通过长短期反思优化机制提升机器人在复杂任务中的适应能力,实现自我进化,优于现有方法。

Comments This work has been accepted for publication in the Proceedings of the 2026 International Joint Conference on Neural Networks (IJCNN 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19771 2026-04-23 cs.CL cs.AI cs.IR 81%

Cognis: Context-Aware Memory for Conversational AI Agents

Cognis:面向对话AI代理的上下文感知内存

Parshva Daftari, Khush Patel, Shreyas Kapale, Jithin George, Siva Surendira

机构 * Lyzr Research(Lyzr研究)

专题命中 记忆与上下文管理 :AI agent(title,abstract);分类 cs.AI、cs.CL

AI总结 Cognis通过多阶段检索管道解决LLM代理缺乏持久记忆的问题,结合双存储后端和向量相似性搜索,实现智能版本追踪和时间敏感查询增强,展现先进性能。

Comments 30 pages, 8 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏