arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-07 至 2026-04-07 共收录 12 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 12 篇

2604.03282 2026-04-07 eess.SY cs.AI cs.SY 83%

Customized User Plane Processing via Code Generating AI Agents for Next Generation Mobile Networks

通过代码生成AI代理实现定制化用户平面处理以适用于下一代移动网络

Xiaowen Ma, Onur Ayan, Yunpu Ma, Xueli An

专题命中 软件智能体 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文研究了利用AI代理生成定制化处理模块的方法,探讨了模型选择、提示设计和代码模板对生成准确性的影响,证明AI代理能在合适条件下实现所需行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04238 2026-04-07 cs.PL 82%

Agentic Code Optimization via Compiler-LLM Cooperation

通过编译器-LLM协作实现代理代码优化

Benjamin Mikek, Danylo Vashchilenko, Bryan Lu, Panpan Xu

专题命中 软件智能体 :agentic(title);agent(abstract);multi-agent(abstract)

AI总结 本文提出编译器-LLM协作方法,结合传统编译优化与LLM生成,提升代码性能,实验显示比现有方法快1.25倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09901 2026-04-07 cs.AI 79%

Autonomous Agents for Scientific Discovery: Orchestrating Scientists, Language, Code, and Physics

自主代理用于科学发现:协调科学家、语言、代码和物理

Lianhao Zhou, Hongyi Ling, Cong Fu, Yepeng Huang, Michael Sun, Wendi Yu, Xiaoxuan Wang, Xiner Li, Xingyu Su, Junkai Zhang, Xiusi Chen, Chenxing Liang, Xiaofeng Qian, Heng Ji, Wei Wang, Marinka Zitnik, Shuiwang Ji

机构 * Department of Computer Science and Engineering, Texas A&M University(德克萨斯农工大学计算机科学与工程系) Department of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学系) Computer Science and Artificial Intelligence Laboratory, Massachusetts Institute of Technology(麻省理工学院计算机科学与人工智能实验室) Department of Computer Science, University of California, Los Angeles(加州大学洛杉矶分校计算机科学系) Siebel School of Computing and Data Science, University of Illinois Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校西贝尔计算与数据科学学院) Department of Materials Science and Engineering, Texas A&M University(德克萨斯农工大学材料科学与工程系) Department of Electrical and Computer Engineering, Texas A&M University(德克萨斯农工大学电气与计算机工程系) Department of Physics and Astronomy, Texas A&M University(德克萨斯农工大学物理与天文学系)

专题命中 软件智能体 :autonomous agent(title,abstract);分类 cs.AI

AI总结 本文探讨基于LLM的科学代理,通过协调科学家、语言、代码和物理,加速科学发现的全过程,分析现有方法并提出未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04059 2026-04-07 cs.SE 79%

Humans Integrate, Agents Fix: How Agent-Authored Pull Requests Are Referenced in Practice

人类整合,代理修复:代理撰写的拉取请求在实践中是如何被引用的

Islem Khemissi, Moataz Chouchen, Dong Wang, Raula Gaikovina Kula

专题命中 软件智能体 :agent(title,abstract);分类 cs.SE

AI总结 研究通过分析AIDev数据集中的代理撰写的拉取请求引用,揭示了人类与代理之间引用意图的分类,发现人类主要用于构建新功能,而代理用于修复错误,且引用的拉取请求生命周期更长,审查时间更长。

Comments Accepted to MSR Mining Challenge paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17581 2026-04-07 cs.SE cs.AI 73%

How AI Coding Agents Modify Code: A Large-Scale Study of GitHub Pull Requests

AI代码代理如何修改代码:对GitHub拉取请求的大型研究

Daniel Ogenrwot, John Businge

机构 * University of Nevada Las Vegas(内华达大学拉斯维加斯分校)

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 研究通过分析GitHub拉取请求中的代码修改,探讨AI代理与人类贡献在提交数量、文件修改和描述一致性上的差异。

Comments Accepted at the 23rd IEEE/ACM International Conference on Mining Software Repositories - Mining Challenge Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04580 2026-04-07 cs.SE 70%

Beyond Fixed Tests: Repository-Level Issue Resolution as Coevolution of Code and Behavioral Constraints

超越固定测试:仓库级问题解决作为代码和行为约束的共进化

Kefan Li, Yuan Yuan, Mengfei Wang, Shihao Zheng, Wei Wang, Ping Yang, Mu Li, Weifeng Lv

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.SE

AI总结 本文提出Agent-CoEvo框架,通过共进化代码与行为约束提升修复效果,优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03400 2026-04-07 cs.CV cs.AI cs.LG 66%

Banana100: Breaking NR-IQA Metrics by 100 Iterative Image Replications with Nano Banana Pro

Banana100: 通过100次迭代图像复制打破NR-IQA度量标准

Kenan Tang, Praveen Arunshankar, Andong Hua, Anthony Yang, Yao Qin

机构 * University of California, Santa Barbara(加州大学圣塔芭芭拉分校)

专题命中 软件智能体 :agentic(abstract,comments);分类 cs.AI、cs.LG

AI总结 Banana100通过100次迭代编辑生成28000张退化图像,揭示多轮编辑中图像质量退化问题,发现现有NR-IQA度量标准无法检测严重退化图像,威胁未来模型训练稳定性。

Comments Accepted to CVPR 2026 Workshop on Agentic AI for Visual Media

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26567 2026-04-07 cs.SE cs.AI 62%

Beyond Code Snippets: Benchmarking LLMs on Repository-Level Question Answering

超越代码片段:在仓库层面评估大语言模型的问答任务

Yoseph Berhanu Alebachew, Hunter Leary, Swanand Vaishampayan, Chris Brown

机构 * Department of Computer Science, Virginia Tech(弗吉尼亚理工大学计算机科学系)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文提出StackRepoQA数据集,用于评估大语言模型在多项目仓库层面的问答能力,通过对比不同配置下的性能,揭示了模型在处理仓库级程序理解时的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04045 2026-04-07 cs.SE 57%

SmartPatchLinker: An Open-Source Tool to Linked Changes Detection for Code Review

SmartPatchLinker:一种开源工具,用于代码审查中的变更检测链接

Islem Khemissi, Moataz Chouchen, Dong Wang, Raula Gaikovina Kula

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 SmartPatchLinker是一款基于浏览器的开源工具,用于在代码审查界面中发现相关变更,通过轻量级Chrome扩展和Gerrit集成,帮助审查人员高效识别语义关联的代码变更,提升代码审查效率。

Comments FSE26 Tool Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03851 2026-04-07 cs.SE 57%

Beyond Crash-to-Patch: Patch Evolution for Linux Kernel Repair

超越崩溃到补丁:Linux内核修复的补丁演变

Luyao Bai, Kenan Alghythee, Hang Zhang, Xiaoguang Wang

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 本文研究Linux内核修复的补丁演变过程,提出PatchAdvisor框架,通过整合检索与诊断顾问,提升修复质量与审查一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03610 2026-04-07 cs.SE 57%

DebugHarness: Emulating Human Dynamic Debugging for Autonomous Program Repair

DebugHarness: 模拟人类动态调试以实现自主程序修复

Maolin Sun, Yibiao Yang, Xuanlin Liu, Yuming Zhou, Baowen Xu

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 DebugHarness通过模拟人类动态调试过程,利用LLM实现复杂漏洞的自动修复,其动态调试方法在SEC-bench数据集上实现了90%的修复率,比现有方法提升30%以上。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03438 2026-04-07 cs.SE 57%

Android Instrumentation Testing in Continuous Integration: Practices, Patterns, and Performance

Android持续集成中的仪器测试:实践、模式与性能

Hamid Parsazadeh, Taher A. Ghaleb, Safwat Hassan

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 研究Android持续集成中仪器测试的实践、模式及性能,发现仅10.6%的仓库使用仪器测试,常用社区组件或自定义脚本设置模拟器,不同设置方式在可靠性、效率和成本上有差异。

Comments Accepted at the 19th IEEE International Conference on Software Testing, Verification and Validation (ICST 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏