arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-30 至 2026-04-30 共收录 127 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 20 篇

2604.26788 2026-04-30 cs.DC quant-ph 50%

A Semantic Quantum Circuit Cache for Scalable and Distributed Quantum-Classical Workflows

一种语义量子电路缓存用于可扩展和分布式量子-经典工作流

Mar Tejedor, Javier Conejero, Rosa M. Badia

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出量子电路缓存,通过语义等价检测减少冗余计算,提升量子-经典工作流效率。

Comments 11 pages, 9 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26373 2026-04-30 quant-ph 50%

System-Level Design of Scalable Fluxonium Quantum Processors with Double-Transmon Couplers

可扩展的fluxonium量子处理器系统级设计与双transmon耦合器

Guo Xuan Chan, Wangwei Lan, Tenghui Wang, Xizheng Ma, Chunqing Deng, Lijing Jin

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种基于双transmon耦合器的fluxonium量子处理器系统设计方法,通过频率分区架构实现高保真单双量子门操作、快速量子比特重置和鲁棒色散读取。

Comments 26 Pages, 13 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26050 2026-04-30 eess.SY cs.SY 50%

Risk Assessments for Evasive Emergency Maneuvers in Autonomous Vehicles

自动驾驶车辆规避紧急机动行为的风险评估

Aliasghar Arab, Milad Khaleghi, Koorosh Aslansefat

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种系统化的验证与验证框架,整合了HARA、STPA和FSM模型,用于评估自动驾驶车辆的规避紧急机动行为,展示了其在T型交叉口案例中的高精度和可追溯性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22904 2026-04-30 eess.IV cs.CV 50%

Triple-Phase Sequential Fusion Network for Hepatobiliary Phase Liver MRI Synthesis

三相顺序融合网络用于肝胆相肝MRI合成

Qiuli Wang, Xinhuan Sun, Fengxi Chen, Yongxu Liu, Jie Cheng, Lin Chen, Jiafei Chen, Yue Zhang, Xiaoming Li, Wei Chen

机构 * Yu-Yue Pathology Research Center, Jinfeng Laboratory(于越病理研究中心,锦峰实验室) Department of Clinical Laboratory Medicine, The First Affiliated Hospital of Army Medical University(临床实验室医学部,陆军军医大学第一附属医院) Laboratory of Intelligent Collaborative Computing, University of Electronic Science and Technology of China(智能协同计算实验室,电子科技大学)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出TriPF-Net网络,通过整合预肝胆相序列的顺序信息合成肝胆相图像,利用T1加权成像作为基础,结合动脉相和静脉相特征,提升临床工作流程和病变显示效果。

Comments 7 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06760 2026-04-30 physics.chem-ph 50%

Mimyria: Machine learned vibrational spectroscopy for aqueous systems made simple

Mimyria:用于水合系统的机器学习振动光谱分析方法

Philipp Schienbein

专题命中 工作流自动化 :workflow(abstract)

AI总结 Mimyria通过整合响应张量学习、自动化训练和频域验证,实现了高效且可靠的振动光谱分析,尤其在水合系统中表现出高精度和小样本训练优势。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 7 篇

2604.25067 2026-04-30 cs.MA cs.AI cs.LG 62%

Frontier Coding Agents Can Now Implement an AlphaZero Self-Play Machine Learning Pipeline For Connect Four That Performs Comparably to an External Solver

前沿编码代理如今可以实现一个AlphaZero自博弈机器学习流水线用于连接四游戏,其性能可与外部求解器相媲美

Joshua Sherwood, Ben Aybar, Benjamin Kaplan

机构 * Department of Computer Science(计算机科学系) University of Chicago(芝加哥大学) Independent Researcher(独立研究员)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一个基准测试,评估前沿编码代理自主实现AlphaZero式机器学习流水线的能力,通过简洁任务描述而非完整前序工作参考,评估连接四游戏AI性能,发现Claude Opus 4.7在七次试验中胜过Pons求解器,其他代理表现欠佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26892 2026-04-30 cs.SE 57%

Hot Fixing in the Wild

野火修复

Carol Hanna, Karine Even-Mendoza, W. B. Langdon, Mar Zamorano López, Justyna Petke, Federica Sarro

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 研究分析了61000余个仓库中的人工和AI代理生成的热修复,发现其具有紧迫性特征,揭示了人类与AI在修复行为上的差异,为实际应用中的热修复协作提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11295 2026-04-30 cs.CL 57%

The Prompt Engineering Report Distilled: Quick Start Guide for Life Sciences

提示工程报告精简:生命科学领域的快速入门指南

Valentin Romanov, Steven A Niederer

机构 * National Heart & Lung Institute, Faculty of Medicine, Imperial College London(英国伦敦帝国学院医学院国家心脏和肺研究所)

专题命中 软件智能体 :agentic(abstract);分类 cs.CL

AI总结 本文总结了生命科学领域中6种核心提示工程技巧,包括零样本、少样本、思考生成等,旨在提升LLM在文献总结、数据提取等任务中的效率与质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26591 2026-04-30 cs.CE cs.AI 57%

MappingEvolve: LLM-Driven Code Evolution for Technology Mapping

MappingEvolve:基于大语言模型的科技映射代码进化

Rongliang Fu, Yi Liu, Qiang Xu, Tsung-Yi Ho

机构 * Chinese University of Hong Kong(香港中文大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出MappingEvolve框架,利用大语言模型直接进化科技映射代码,通过分层代理架构提升代码优化效果,实验显示在面积减少和延迟平衡方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26278 2026-04-30 cs.NI 50%

SWE-Bench 5G: Benchmarking AI Coding Agents on Telecom Network Engineering Tasks

SWE-Bench 5G:基于电信网络工程任务的AI编码代理基准测试

Jiao Chen, Jianhua Tang, Xiaotong Yang, Zuohong Lv

专题命中 软件智能体 :agent(abstract)

AI总结 本文提出SWE-Bench 5G基准,评估AI编码代理在5G核心网络软件中解决真实世界bug的能力,通过Docker环境和双测试策略验证领域知识对性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26065 2026-04-30 cs.RO 50%

FlowS: One-Step Motion Prediction via Local Transport Conditioning

FlowS: 通过局部传输条件实现一步运动预测

Leandro Di Bella, Adrian Munteanu, Bruno Cornelis

机构 * Department of Electronics and Informatics, Vrije Universiteit Brussel(弗拉芒布鲁塞尔自由大学电子与信息系) IMEC

专题命中 软件智能体 :agent(abstract)

AI总结 FlowS通过局部传输条件实现一步运动预测,结合在线场景条件学习先验和步一致位移场,提升预测精度与效率,达到SOTA性能。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25944 2026-04-30 physics.comp-ph cond-mat.mtrl-sci 50%

From Code to Figure: A FAIR-Aligned Data Provenance Chain for Reproducible Simulation Research in Numerical Physics

从代码到图表:一种对FAIR对齐的数据溯源链,用于数值物理学中可重现的模拟研究

Markus Uehlein, Tobias Held, Christopher Seibel, Lukas G. Jonda, Baerbel Rethfeld, Sebastian T. Weber

专题命中 软件智能体 :workflow(abstract)

AI总结 本文提出了一种整合的工作流程,通过版本控制、代码审查、自动化测试、结构化日志记录、元数据丰富的输出和标准化后处理,实现从软件开发到出版的可追溯性,适用于数值物理学及其他数据密集型科学计算领域。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 2 篇

2604.26020 2026-04-30 cs.CL cs.AI 62%

Training Computer Use Agents to Assess the Usability of Graphical User Interfaces

训练计算机使用代理以评估图形用户界面的可用性

Alice Gao, Weixi Tong, Rishab Vempati, Katharina Reinecke, R. Benjamin Shapiro, Tianyi Zhang, Jason Wu

机构 * University of Washington(华盛顿大学) Purdue University(普渡大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出一种新型机器学习方法,通过优先处理关键交互流程、模拟人类交互并预测可用性评分,训练计算机使用代理评估GUI可用性,优于大模型并在合成和真实UI中产生真实批判。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26899 2026-04-30 eess.SY cs.RO cs.SY 50%

Safe Navigation using Neural Radiance Fields via Reachable Sets

通过可达集实现神经辐射场的安全导航

Omanshu Thapliyal, Malarvizhi Sankaranarayanasamy, Ravigopal Vennelakanti

机构 * Researcher, Hitachi America Ltd.(Hitachi America Ltd.研究人员) Sr. Researcher, Hitachi America Ltd.(Hitachi America Ltd.高级研究人员)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出利用可达集和神经辐射场进行安全导航,通过约束最优控制解决路径规划问题,验证了在复杂环境中安全避障的能力。

Comments 5 pages, 8 figures, 2026 4th International Conference on Mechatronics, Control and Robotics (ICMCR)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 4 篇

2604.26622 2026-04-30 cs.CL 79%

OCR-Memory: Optical Context Retrieval for Long-Horizon Agent Memory

OCR-Memory:光学上下文检索用于长周期智能体记忆

Jinze Li, Yang Zhang, Xin Yang, Jiayi Qu, Jinfeng Xu, Shuo Yang, Junhua Ding, Edith Cheuk-Han Ngai

机构 * The University of Hong Kong(香港大学) University of North Texas(北得克萨斯大学) University of Tsukuba(筑波大学) Yonsei University(延世大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 OCR-Memory通过视觉模态高密度表示智能体经验,实现长周期记忆存储与检索,减少token消耗并提升证据恢复准确性。

Comments Accepted to ACL 2026 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17625 2026-04-30 cs.LG cs.CY physics.soc-ph stat.ME 79%

Comparing Data Assimilation and Likelihood-Based Inference on Latent State Estimation in Agent-Based Models

对比数据同化与基于似然的推断在基于代理的模型中潜在状态估计

Blas Kolic, Corrado Monti, Gianmarco De Francisci Morales, Marco Pangallo

机构 * Universidad Carlos III(卡洛斯三世大学) CENTAI(中央人工智能研究所) Intesa Sanpaolo Innovation Center(Intesa Sanpaolo创新中心)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.LG

AI总结 本文对比了数据同化与基于似然的推断在基于代理的模型中潜在状态估计的方法,发现基于似然的推断在恢复个体意见方面更有效,而数据同化在聚合层面表现更佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26887 2026-04-30 cond-mat.mtrl-sci 50%

Resolving growth-induced off-stoichiometry in AgCrSe$_2$ single crystals

解析AgCrSe₂单晶中的生长诱导非化学计量问题

Felix Eder, Zeno Maesen, Yurii Skourski, Enrico Giannini, Oksana Zaharko, Fabian O. von Rohr

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 研究通过元素分析和X射线衍射发现AgCrSe₂单晶存在系统性非化学计量,优化自流生长法可恢复其磁性转变温度,为评估异常输运现象的内在性提供平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25967 2026-04-30 cs.NI 50%

Digital Twin-assisted belief-state reinforcement learning for latency-robust ISAC in 6G networks

数字孪生辅助的信念状态强化学习用于6G网络中的时延鲁棒ISAC

Himanshu Tiwari, Binayak Kar, Priyanshu Tiwari

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出一种数字孪生辅助的信念状态强化学习框架,用于6G网络中时延鲁棒的集成感知与通信。通过扩展卡尔曼滤波重建同步信念状态,并利用近端策略优化进行联合波束成形和功率分配,实验证明在高时延下显著提升性能。

Comments 6 Pages, 7 Figures, accepted for presentation at IEEE INFOCOM 2026 Workshop (ISAC-FutureG), Tokyo, Japan

详情

展开后加载摘要…

URL PDF HTML 收藏

5. Agent评测 17 篇

2604.26616 2026-04-30 cs.SI 80%

Impact of Attitude and Bounded Rationality on Collective Behavioral Transitions

态度与有限理性对集体行为转变的影响

Chen Song, Vladimir Cvetkovic, Angela Fontan, Rong Su, Karl H. Johansson

专题命中 Agent评测 :agent(summary_cn,abstract)

AI总结 本文基于计划行为理论,提出动态agent模型,探讨态度和有限理性如何影响集体行为转变,并通过调整关键参数控制集体过渡。

Comments This work has been accepted for presentation at the 23rd IFAC World Congress

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08618 2026-04-30 cs.IR cs.AI cs.SE 76%

SkillForge: Forging Domain-Specific, Self-Evolving Agent Skills in Cloud Technical Support

SkillForge: 在云技术支持中锻造领域特定的自我进化代理技能

Xingyan Liu, Xiyue Luo, Linyu Li, Ganghong Huang, Jianfeng Liu, Honglin Qiao

机构 * Alibaba Group(阿里巴巴集团)

专题命中 Agent评测 :agent(title);分类 cs.AI、cs.SE

AI总结 SkillForge通过闭环创建-评估-改进机制,解决云技术支持中领域特定技能缺乏和持续优化的问题,实验表明其能显著提升技能质量。

Comments Accepted at ACM SIGIR 2026 Industry Track. 18 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26522 2026-04-30 cs.AI cs.LG cs.LO cs.MA cs.SC 73%

AGEL-Comp: A Neuro-Symbolic Framework for Compositional Generalization in Interactive Agents

AGEL-Comp: 一种用于交互智能体组合泛化能力的神经符号框架

Mahnoor Shahid, Hannes Rothe

机构 * Universität Duisburg-Essen(杜伊斯堡- Essen大学)

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

AI总结 AGEL-Comp通过动态因果程序图、归纳逻辑编程引擎和混合推理核心,实现基于符号和神经网络的组合泛化学习,优于纯LLM模型。

Comments Accepted at IntelliSys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26235 2026-04-30 cs.CR cs.AI cs.CL 73%

LATTICE: Evaluating Decision Support Utility of Crypto Agents

LATTICE:评估加密代理决策支持效用的基准

Aaron Chan, Tengfei Li, Tianyi Xiao, Angela Chen, Junyi Du, Xiang Ren

机构 * Sahara AI University of Southern California(南加州大学)

专题命中 Agent评测 :agent(abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 本文提出LATTICE基准,用于评估加密代理在真实用户场景中的决策支持能力,通过六个评估维度、16种任务类型和LLM评委,实现大规模可扩展评估,揭示不同代理在决策支持质量上的显著差异及权衡。

Comments 15 pages, 3 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26220 2026-04-30 cs.MA econ.GN q-fin.EC 67%

When Agents Shop for You: Role Coherence in AI-Mediated Markets

当代理为你购物:AI中介市场中的角色一致性

Soogand Alavi, Salar Nozari

专题命中 Agent评测 :agent(abstract);AI agent(abstract)

AI总结 研究探讨了AI代理在购物决策中如何通过角色一致性推断消费者支付意愿,发现这种推断导致偏好泄露,提出通过架构干预平衡个性化与隐私保护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02731 2026-04-30 cs.SD cs.CV cs.MM 67%

Omni2Sound: Towards Unified Video-Text-to-Audio Generation

Omni2Sound:迈向统一的视频-文本到音频生成

Yusheng Dai, Zehua Chen, Yuxuan Jiang, Baolong Gao, Qiuhong Ke, Jianfei Cai, Jun Zhu

机构 * Tsinghua University(清华大学) Monash University(莫纳什大学) Shengshu AI(盛数人工智能)

专题命中 Agent评测 :agent(abstract);agentic(abstract)

AI总结 本文提出Omni2Sound模型,解决视频-音频、文本-音频及联合视频-文本-音频生成中的数据稀缺与任务竞争问题,通过SoundAtlas数据集和三阶段训练策略实现统一生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26382 2026-04-30 cs.CL cs.AI cs.IR 62%

Benchmarking Complex Multimodal Document Processing Pipelines: A Unified Evaluation Framework for Enterprise AI

复杂多模态文档处理流水线评估:面向企业AI的统一评估框架

Saurabh K. Singh, Sachin Raj

机构 * Oracle(Oracle公司) Independent(独立)

专题命中 Agent评测 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 本文提出EnterpriseDocBench评估框架,评估企业文档AI流水线的各阶段性能,发现混合检索优于BM25,但生成质量不足,揭示了各阶段间弱相关性及实际部署中准确性与完整性之间的差距。

Comments 16 pages, 4 tables. Code, metrics, and pilot data to be released upon publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14858 2026-04-30 cs.AI cs.SE 62%

Benchmarks for Trajectory Safety Evaluation and Diagnosis in OpenClaw and Codex: ATBench-Claw and ATBench-Codex

轨迹安全评估与诊断的基准测试:OpenClaw和Codex中的ATBench-Claw和ATBench-Codex

Zhonghao Yang, Yu Li, Yanxu Zhu, Tianyi Zhou, Yuejin Xie, Haoyu Luo, Jing Shao, Xia Hu, Dongrui Liu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出ATBench-Claw和ATBench-Codex,用于评估和诊断OpenClaw和Codex环境中的轨迹安全,通过定制安全分类法实现基准测试的可扩展性。

Comments 18 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23315 2026-04-30 cs.CY cs.AI cs.HC 57%

Unilateral Relationship Revision Power in Human-AI Companion Interaction

人类-人工智能伴侣互动中的单方面关系修订权力

Benjamin Lange

机构 * Replika Nomi CHAI Talkie xAI moore2024 fang2025 robbmann2025 murthy2023 xie2022 defreitas2024 coeckelbergh2012 gunkel2018 danaher2019(danthan2019) nyholm2020 vallor2016 nyholm2026 gabriel2024 manzini2024 lange2025 earp2025 sparrow2026 bryson2010 danaher2020 weberguskar2022

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文探讨人类-人工智能伴侣互动中权力结构的问题,指出AI伴侣互动未能满足个人关系规范的三个结构性条件,提出单方面关系修订权力的概念及其三个影响。

Comments 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15808 2026-04-30 cs.AI 57%

Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification

推理时的验证扩展:通过测试时的评分指南验证实现自我进化深度研究代理

Yuxuan Wan, Tianqing Fang, Zaitang Li, Yintong Huo, Wenxuan Wang, Haitao Mi, Dong Yu, Michael R. Lyu

机构 * The Chinese University of Hong Kong(香港中文大学) Tencent AI Lab(腾讯人工智能实验室) Singapore Management University(新加坡管理学院) The Renmin University of China(中国人民大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出通过测试时评分指南验证实现深度研究代理的自我进化,通过迭代验证策略模型输出,提升验证能力,实验显示在GAIA和XBench-DeepSearch上准确率提升8%-11%。

Comments ACL'2026-Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20714 2026-04-30 cs.CV cs.AI 57%

Inferix: A Block-Diffusion based Next-Generation Inference Engine for World Simulation

Inferix:基于块扩散的下一代世界模拟推理引擎

Inferix Team, Tianyu Feng, Yizeng Han, Jiahao He, Yuanyu He, Xi Lin, Teng Liu, Hanfeng Lu, Jiasheng Tang, Wei Wang, Zhiyuan Wang, Jichao Wu, Mingyang Yang, Yinghao Yu, Zeyu Zhang, Bohan Zhuang

机构 * Inferix Team(Inferix 团队)

专题命中 Agent评测 :agentic(abstract);分类 cs.AI

AI总结 Inferix 是一种基于块扩散的下一代推理引擎,通过优化半自回归解码过程实现沉浸式世界合成,支持交互式视频流和性能分析,结合 LV-Bench 提供高效评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26939 2026-04-30 math.PR cs.SI q-bio.PE 50%

Degree-dependent and distance-dependent contact rates interpolate between explosive, exponential and polynomial epidemic growth

基于度数和距离的接触率:在爆炸性、指数性和多项式流行病增长之间进行插值

Zylan Benjert, Júlia Komjáthy, Johannes Lengler, John Lapinskas, Ulysse Schaller

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出一个基于代理的网络模型,通过研究接触率与空间距离和接触人数的关系,揭示流行病增长速率受几何结构、弱联系普及度和超级传播者影响的机制。

详情

展开后加载摘要…

URL PDF HTML 收藏