arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-29 至 2026-04-29 共收录 19 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 19 篇

2604.25135 2026-04-29 cs.CL 90%

FAMA: Failure-Aware Meta-Agentic Framework for Open-Source LLMs in Interactive Tool Use Environments

FAMA:面向交互工具使用环境的开源大语言模型失败意识元代理框架

Amir Saeidi, Venkatesh Mishra, Souradeep Mukhopadhyay, Gaowen Liu, Ali Payani, Jayanth Srinivasa, Chitta Baral

机构 * Arizona State University(亚利桑那州立大学) Cisco Research(思科研究)

专题命中 工作流自动化 :agentic(title,abstract);tool use(title);agent(abstract);autonomous agent(abstract)

AI总结 FAMA框架通过分析基线代理的失败轨迹识别常见错误,并利用 orchestration 机制激活专门的代理来针对性解决失败问题,实验显示在开源LLM上性能提升达27%。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25684 2026-04-29 cs.AI 85%

Think Before You Act -- A Neurocognitive Governance Model for Autonomous AI Agents

在行动前思考--一种用于自主AI代理的神经认知治理模型

Eranga Bandara, Ross Gore, Asanga Gunaratna, Sachini Rajapakse, Isurunima Kularathna, Ravi Mukkamala, Sachin Shetty, Xueping Liang, Amin Hass, Tharaka Hewa, Abdul Rahman, Christopher K. Rhea, Anita H. Clayton, Preston Samuel, Atmaram Yarlagadda

机构 * Old Dominion University(老奥德纳大学) AI Motion Labs(AI运动实验室) Department of Psychiatry and Neurobehavioral Sciences(精神病学与神经行为科学系) University of Virginia School of Medicine(弗吉尼亚大学医学院) Florida International University(佛罗里达国际大学) Accenture Technology Labs(埃森哲技术实验室) Center for Wireless Communications(无线通信中心) University of Oulu(奥卢大学) Blanchfield Army Community Hospital(布莱恩菲尔德陆军社区医院) McDonald Army Health Center(麦克唐纳陆军健康中心)

专题命中 工作流自动化 :AI agent(title,abstract);agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出一种神经认知治理框架,通过将人类自我治理过程映射到LLM驱动的代理推理中,实现95%的合规准确率和零人工监督升级,展示嵌入治理的代理推理能产生更一致、可解释和可审计的合规性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25256 2026-04-29 cs.AI 83%

AutoResearchBench: Benchmarking AI Agents on Complex Scientific Literature Discovery

AutoResearchBench:基于复杂科学文献发现的AI代理基准测试

Lei Xiong, Kun Luo, Ziyi Xia, Wenbo Zhang, Jin-Ge Yao, Zheng Liu, Jingying Shao, Jianlyu Chen, Hongjin Qian, Xi Yang, Qian Yu, Hao Li, Chen Yue, Xiaan Du, Yuyang Wang, Yesheng Liu, Haiyu Xu, Zhicheng Dou

机构 * AutoResearchBench Team(AutoResearchBench团队)

专题命中 工作流自动化 :AI agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出AutoResearchBench,用于评估AI代理在复杂科学文献发现中的能力,包含深度研究和广泛研究两种任务,相比现有代理网络浏览基准,其研究导向、文献聚焦和开放性特征使其更具挑战性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25857 2026-04-29 cs.NI 78%

Slice Agent: Identifying and Isolating Slices in Shared Open Radio Unit

切片代理:在共享开放射频单元中识别和隔离切片

Felipe Arnholda, Flavio Rocha, Lucio Prade, Cristiano Bonato Both

专题命中 工作流自动化 :agent(title,abstract)

AI总结 本文提出在共享开放射频单元中嵌入切片代理,通过专用路径实现时间敏感的灵活切片,以支持超低延迟的切片识别和隔离,适用于5G和6G开放RAN部署。

Comments 40 pages, 13 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25657 2026-04-29 cs.HC 78%

ClayScape: A GenAI-Supported Workflow for Designing Chinese Style Ceramics with Clay 3D Printing

ClayScape:一种由生成式人工智能支持的中国陶瓷设计工作流程

Sijia Liu, Hoi Ching Silvester Mok, Long Ling, Tobias Klein, Ray LC

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 本文提出一种结合生成式AI与黏土3D打印的混合工作流程,通过ClayScape设计工具评估,展示了在文化根基陶瓷实践中降低数字制造门槛并支持创意探索的可能性。

Comments Designing Interactive Systems Conference (DIS '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25557 2026-04-29 hep-ph physics.comp-ph 78%

Jarvis-HEP: A lightweight Python framework for workflow composition and parameter scans in high-energy physics

Jarvis-HEP:一个轻量级的Python框架,用于高能物理中的工作流组合和参数扫描

Erdong Guo, Paul Jackson, Jin Min Yang, Pengxuan Zhu

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 本文介绍Jarvis-HEP,一个用于高能物理中工作流组合和参数扫描的轻量级Python框架,支持统一的工作流规范、依赖感知执行和异步任务调度,通过合成和现象学示例展示其应用。

Comments 33 pages, 8 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12672 2026-04-29 cs.DC 78%

Workflow as a Service Broker in Cloud Environment: A Systematic Mapping Study

云环境中的工作流作为服务代理:系统映射研究

Saeid Abrishami, Faridreza Momtaz Zandi, Alireza Nourbakhsh

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 本文通过系统映射研究分析云环境中工作流作为服务代理的关键趋势与挑战,采用三级策略分析87篇高质量论文,构建了WaaS代理的分类体系,并探讨了未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25676 2026-04-29 cs.CL cs.AI 73%

CORAL: Adaptive Retrieval Loop for Culturally-Aligned Multilingual RAG

CORAL:面向文化对齐的多语言RAG自适应检索循环

Nayeon Lee, Jiwoo Song, Byeongcheol Kang

机构 * Naver(纳维尔) Samsung Research(三星研究院)

专题命中 工作流自动化 :agentic(abstract,abstract_cn);分类 cs.AI、cs.CL

AI总结 CORAL通过迭代优化检索空间和查询,提升多语言检索生成在文化相关性上的表现,实验显示在低资源语言上准确率提升3.58%。

Comments 23 pages, 9 figures. Accepted at ACL 2026 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25849 2026-04-29 cs.AI 70%

ADEMA: A Knowledge-State Orchestration Architecture for Long-Horizon Knowledge Synthesis with LLMAgents

ADEMA:一种用于长周期知识综合的知觉状态 orchestration 架构与 LLMAgents

Zhou Hanlin, Chan Huah Yong

机构 * School of Computer Sciences, Universiti Sains Malaysia (USM)(国际 sciences 大学 (USM) 计算机科学学院) Xiamen Software Vocational & Technical College(厦门软件职业技术学院)

专题命中 工作流自动化 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出 ADEMA 架构,通过显式知识状态管理、双评估治理、自适应任务模式切换等方法,解决长周期知识综合中知识状态漂移、中间承诺隐含等问题,强调显式证据链和可恢复连续性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25389 2026-04-29 cs.HC cs.AI 70%

Co-Writing with AI: An Empirical Study of Diverse Academic Writing Workflows

与AI共同写作:关于多样化学术写作流程的实证研究

Silvia Bodei, Duncan P. Brumby, Katie Fisher, Jon Mella

机构 * University College London(伦敦大学学院)

专题命中 工作流自动化 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 研究探讨大学生如何整合AI工具到写作流程中,分析不同写作任务中AI使用模式及个体因素影响,揭示AI整合的多样性与三种价值导向的配置。

Comments 25 pages, 1 table, 5 figures. Accepted at CHIWORK 2026 (ACM Symposium on Human-Computer Interaction for Work)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18030 2026-04-29 cs.CL cs.AI cs.LG 67%

From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models

从局部到全局:重新审视大型语言模型的结构剪枝范式

Ziyan Wang, Enmao Diao, Qi Le, Pu Wang, Minwoo Lee, Shu-ping Yeh, Evgeny Stupachenko, Hao Feng, Li Yang

机构 * University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校) DreamSoul University of Minnesota(明尼苏达大学) Intel Corporation(英特尔公司)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出GISP,一种基于全局重要性度量的迭代结构剪枝方法,通过去除注意力头和MLP通道提升模型效率和下游任务性能。

Comments 20 pages, 6 figures. Accepted by ACL2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25689 2026-04-29 cs.SE cs.AI 62%

Spreadsheet Modeling Experiments Using GPTs on Small Problem Statements and the Wall Task

使用GPTs在小问题陈述和墙任务上进行电子表格建模实验

Thomas A. Grossman, Yuan Chen, Sopiko Datuashvili

机构 * University of San Francisco(旧金山大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.SE

AI总结 本文研究GPT工具在构建可重用分析电子表格模型中的作用,通过测试发现Excel AI在结构化实验中表现不一致且不可复现,指出需要专业用户验证和调整。

Journal ref Proceedings of the EuSpRIG 2025 Conference: Spreadsheet Productivity & Risks ISBN : 978-1-905404-60-5

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25482 2026-04-29 cs.CL cs.AI 62%

From World-Gen to Quest-Line: A Dependency-Driven Prompt Pipeline for Coherent RPG Generation

从World-Gen到Quest-Line:一种依赖驱动的提示管道用于连贯的RPG生成

Dominik Borawski, Marta Szulc, Robert Chudy, Małgorzata Giedrowicz, Piotr Mironowicz

机构 * Gdańsk University of Technology(格但斯克技术大学)

专题命中 工作流自动化 :planning(abstract);分类 cs.AI、cs.CL

AI总结 本文提出一种依赖驱动的提示管道,通过结构化中间表示建模叙事依赖,以生成连贯的RPG内容。该方法通过分阶段生成世界构建、NPC创建、玩家角色创建、战役级任务规划和任务扩展,减少叙事漂移并支持可扩展的叙事元素生成。

Comments 13 pages, 1 figure, 5 listings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09723 2026-04-29 cs.CL cs.AI 62%

RbtAct: Rebuttal as Supervision for Actionable Review Feedback Generation

RbtAct: 用于生成可操作性评审反馈的反驳作为监督

Sihong Wu, Yiling Ma, Yilun Zhao, Tiansheng Hu, Owen Jiang, Manasi Patwardhan, Arman Cohan

机构 * Yale University(耶鲁大学) New York University(纽约大学) TCS Research(TCS研究院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 本文提出RbtAct,通过利用反驳作为隐式监督,优化反馈生成器以提高可操作性。引入了视角条件段级评审反馈生成任务,并构建了RMR-75K数据集,实验表明在可操作性和具体性上优于基线模型。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10718 2026-04-29 cs.LG cs.CL 62%

SnapMLA: Efficient Long-Context MLA Decoding via Hardware-Aware FP8 Quantized Pipelining

SnapMLA: 通过硬件感知的FP8量化流水线实现高效的长上下文MLA解码

Yifan Zhang, Zunhai Su, Shuhao Hu, Rui Yang, Wei Wu, Yulei Qian, Yuchen Xie, Xunliang Cai

机构 * Meituan LongCat Team(美团LongCat团队) Tsinghua University(清华大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL、cs.LG

AI总结 SnapMLA通过硬件感知的FP8量化流水线优化,提升长上下文解码效率,实验显示在长输出解码任务中吞吐量提升达1.91倍,同时在推理和代码生成基准上与BF16基线表现相近。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06778 2026-04-29 cs.CL cs.AI 62%

Large Language Models Are Effective Human Annotation Assistants, But Not Good Independent Annotators

大语言模型是有效的标注助手,但不是好的独立标注者

Feng Gu, Zongxia Li, Carlos Rafael Colon, Benjamin Evans, Ishani Mondal, Jordan Lee Boyd-Graber

机构 * Department of Computer Science, University of Maryland(大学计算机科学系) National Consortium for the Study of Terrorism and Responses to Terrorism(反恐与反恐响应国家研究中心)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 本文研究了大语言模型在事件标注中的有效性,发现其在辅助专家标注时表现优于传统方法,但独立标注仍不理想。

Comments 9 pages, 4 figures

Journal ref ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12749 2026-04-29 quant-ph 50%

RandomMeas.jl: A Julia Package for Randomized Measurements in Quantum Devices

RandomMeas.jl:用于量子设备中随机测量的Julia包

Andreas Elben, Benoît Vermersch

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文介绍RandomMeas.jl,一个用于实现和分析量子计算中随机测量协议的高性能Julia包,提供从生成测量设置到经典影方法的完整流程及多种估计器。

Comments Version accepted in Quantum Journal. 15 pages, code available at https://github.com/bvermersch/RandomMeas.jl

Journal ref Quantum 10, 2086 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24793 2026-04-29 eess.IV cs.CV 50%

CRC-SAM: SAM-Based Multi-Modal Segmentation and Quantification of Colorectal Cancer in CT, Colonoscopy, and Histology Images

CRC-SAM:基于SAM的多模态结直肠癌在CT、结肠镜和组织学图像中的分割与量化

Daniel Lao

机构 * Independent researcher(独立研究者)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出CRC-SAM框架,实现跨结肠镜、CT和病理图像的结直肠癌分割,通过LoRA层实现高效领域迁移,实验显示在多个数据集上优于现有方法。

Comments 4 pages, 3 figures, ISBI 2026 oral presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13818 2026-04-29 cs.PF 50%

denet, A lightweight command-line tool for process monitoring in benchmarking and beyond

denet:一种轻量级的命令行工具,用于在基准测试中监控进程及更广泛的应用

Ben Carrillo, Izaskun Mallona

专题命中 工作流自动化 :workflow(abstract)

AI总结 denet提供实时进程资源分析,支持CPU、内存、磁盘I/O、网络活动和线程使用,适用于生物信息学等数据密集型管道的基准测试与调优。

Comments 8 pages, 1 figure, 1 supplementary

详情

展开后加载摘要…

URL PDF HTML 收藏