arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 3200 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 3200 篇

2508.11867 2026-02-24 cs.SE cs.AI 73%

AI-Augmented CI/CD Pipelines: From Code Commit to Production with Autonomous Decisions

AI增强的CI/CD流水线:从代码提交到生产中的自主决策

Mohammad Baqar, Saba Naqvi, Rajat Khanda

专题命中 软件智能体 :autonomous agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文提出AI增强的CI/CD流水线,利用大语言模型和自主代理提升软件交付效率,通过参考架构、决策分类法和信任层级框架实现自动化决策,减少人工干预和延迟。

Comments 13 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06975 2026-02-10 cs.CL cs.AI 73%

BiomechAgent: AI-Assisted Biomechanical Analysis Through Code-Generating Agents

BiomechAgent: 通过代码生成代理实现AI辅助的生物力学分析

R. James Cotton, Thomas Leonard

机构 * Shirley Ryan AbilityLab Northwestern University(Shirley Ryan AbilityLab 北卡罗来纳大学)

专题命中 软件智能体 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL

AI总结 BiomechAgent通过自然语言和代码生成技术,使无标记运动捕捉数据的生物力学分析更易被非编程用户使用,提升临床应用的效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16975 2026-02-09 cs.SE cs.CL 73%

SWE-Dev: Evaluating and Training Autonomous Feature-Driven Software Development

SWE-Dev:评估和训练自主的基于特征驱动的软件开发

Yaxin Du, Yuzhu Cai, Yifan Zhou, Cheng Wang, Yu Qian, Xianghe Pang, Qian Liu, Yue Hu, Siheng Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing University of Aeronautics and Astronautics(北京航空航天大学) The Chinese University of Hong Kong(香港中文大学) University of Michigan(密歇根大学)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL、cs.SE

AI总结 SWE-Dev是一个大规模数据集,用于评估和训练自主编码系统在特征驱动软件开发中的能力,通过提供可运行环境和单元测试提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04296 2026-02-05 cs.SE cs.AI 73%

ProxyWar: Dynamic Assessment of LLM Code Generation in Game Arenas

ProxyWar: 动态评估LLM代码生成在游戏竞技场中的表现

Wenjun Peng, Xinyu Wang, Qi Wu

机构 * adelaide.edu.au(阿德莱德大学)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 ProxyWar通过在动态游戏环境中评估LLM代码生成的质量,揭示了基准分数与实际性能之间的差异,为算法发现和自适应问题解决研究提供新视角。

Comments ICSE2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03183 2026-02-04 cs.CL cs.AI 73%

Privasis: Synthesizing the Largest "Public" Private Dataset from Scratch

Privasis:从零开始合成最大的“公共”私有数据集

Hyunwoo Kim, Niloofar Mireshghallah, Michael Duan, Rui Xin, Shuyue Stella Li, Jaehun Jung, David Acuna, Qi Pang, Hanshen Xiao, G. Edward Suh, Sewoong Oh, Yulia Tsvetkov, Pang Wei Koh, Yejin Choi

机构 * NVIDIA CMU(卡内基梅隆大学) USC(南加州大学)

专题命中 软件智能体 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL

AI总结 Privasis是首个从零开始构建的百万级合成数据集,用于提升隐私敏感领域研究的规模和效率,其模型在隐私净化任务中表现优异。

Comments For code and data, see https://privasis.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02361 2026-02-03 cs.SE cs.AI 73%

SWE-Universe: Scale Real-World Verifiable Environments to Millions

SWE-Universe: 将现实可验证环境扩展至百万级

Mouxiang Chen, Lei Zhang, Yunlong Feng, Xuwu Wang, Wenting Zhao, Ruisheng Cao, Jiaxi Yang, Jiawei Chen, Mingze Li, Zeyao Ma, Hao Ge, Zongmeng Zhang, Zeyu Cui, Dayiheng Liu, Jingren Zhou, Jianling Sun, Junyang Lin, Binyuan Hui

机构 * Qwen Team, Alibaba Group(通义团队,阿里巴巴集团) Zhejiang University(浙江大学)

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 SWE-Universe通过高效框架构建百万级现实可验证环境,提升编码代理训练效果。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02029 2026-02-03 cs.AI cs.SE 73%

Canonical Intermediate Representation for LLM-based optimization problem formulation and code generation

基于LLM的优化问题建模与代码生成的规范中间表示

Zhongyuan Lyu, Shuoyu Hu, Lujie Liu, Hongxia Yang, Ming LI

机构 * The Hong Kong Polytechnic University, Hong Kong, China(香港理工大学)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 本研究提出规范中间表示(CIR)以提升LLM在复杂运营规则下的优化问题建模与代码生成能力,通过多智能体框架实现高精度建模。

Comments 41 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04427 2026-01-27 cs.SE cs.AI 73%

Speed at the Cost of Quality: How Cursor AI Increases Short-Term Velocity and Long-Term Complexity in Open-Source Projects

以质量为代价:Cursor AI如何在开源项目中提升短期速度和长期复杂性

Hao He, Courtney Miller, Shyam Agarwal, Christian Kästner, Bogdan Vasilescu

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文研究Cursor AI对开源项目开发速度和质量的影响,发现其短期提升速度但长期增加代码复杂性,指出质量保障是早期采用者的主要瓶颈。

Journal ref 23rd International Conference on Mining Software Repositories (MSR '26), April 13--14, 2026, Rio de Janeiro, Brazil

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16809 2026-01-26 cs.SE cs.AI 73%

Will It Survive? Deciphering the Fate of AI-Generated Code in Open Source

AI生成代码在开源中的生存状况会怎样?解码AI生成代码的命运

Musfiqur Rahman, Emad Shihab

机构 * Concordia University(康科德大学)

专题命中 软件智能体 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.SE

AI总结 研究发现AI生成代码在开源项目中存活时间更长,但修改特征和预测挑战仍需进一步探索。

Comments This paper has been submitted to EASE 2026 research track and currently under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14523 2026-01-22 cs.AI cs.LG 73%

Large Language Model-Powered Evolutionary Code Optimization on a Phylogenetic Tree

基于进化树的大型语言模型驱动的代码优化

Leyi Zhao, Weijie Huang, Yitong Guo, Jiang Bian, Chenghong Wang, Xuhong Zhang

机构 * Department of Computer Science(计算机科学系) Luddy School of Informatics(信息学院) Indiana University(印第安纳大学)

专题命中 软件智能体 :agent(abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 PhyloEvolve利用大型语言模型和进化算法优化GPU科学计算算法,通过进化树结构提升优化效率和可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06789 2026-01-14 cs.SE cs.AI 73%

MemGovern: Enhancing Code Agents through Learning from Governed Human Experiences

MemGovern:通过学习受控的人类经验增强代码代理

Qihao Wang, Ziming Cheng, Shuo Zhang, Fan Liu, Rui Xu, Heng Lian, Kunyi Wang, Xiaoming Yu, Jianghao Yin, Sen Hu, Yue Hu, Shaolei Zhang, Yanbing Liu, Ronghao Chen, Huacan Wang

机构 * UCAS(中国科学院大学) NUS(新加坡国立大学) ECNU(华东师范大学) FDU(福建师范大学) XDU(西安电子科技大学) UBC(不列颠哥伦比亚大学) HKUST(GZ)(香港科技大学) PKU(北京大学) RUC(中国人民大学) QuantaAlpha(量子阿尔法)

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 MemGovern通过学习受控的人类经验,提升代码代理的修复效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10954 2026-01-06 cs.SE cs.AI 73%

SWE-Factory: Your Automated Factory for Issue Resolution Training Data and Evaluation Benchmarks

SWE-Factory: 你的自动化问题解决训练数据和评估基准工厂

Lianghong Guo, Yanlin Wang, Caihua Li, Wei Tao, Pengyu Yang, Jiachi Chen, Haoyu Song, Duyu Tang, Zibin Zheng

机构 * Sun Yat-sen University(中山大学) Independent Researcher(独立研究者) Huawei Technologies Co, Ltd(华为技术有限公司)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 SWE-Factory通过自动化流程解决GitHub问题解决数据构建中的关键限制,实现高效且准确的评估环境构建与验证。

Comments To appear at FSE'2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03257 2026-01-01 cs.LG cs.AI cs.MA 73%

Triple-BERT: Do We Really Need MARL for Order Dispatch on Ride-Sharing Platforms?

Triple-BERT: 为网约车平台订单调度是否真的需要MARL?

Zijian Zhao, Sen Li

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 Triple-BERT通过动作分解和BERT网络提升网约车平台订单调度效率,实现11.95%的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23713 2026-01-01 cs.CL cs.AI 73%

PyBangla at BLP-2025 Task 2: Enhancing Bangla-to-Python Code Generation with Iterative Self-Correction and Multilingual Agents

在BLP-2025任务2中提升孟加拉语到Python代码生成:通过迭代自我纠正和多语言代理

Jahidul Islam, Md Ataullha, Saiful Azad

机构 * Department of Computer Science and Engineering(计算机科学与工程系)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出BanglaCodeAct框架,通过多代理提示和迭代自我纠正,提升孟加拉语到Python代码生成的性能,实验显示Qwen3-8B结合该框架在开发集和盲测集上分别达到94.0%和71.6%的准确率。

Comments 6 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21757 2025-12-29 cs.SE cs.AI 73%

How Do Agents Perform Code Optimization? An Empirical Study

代理如何执行代码优化?一项实证研究

Huiyun Peng, Antonio Zhong, Ricardo Andrés Calvo Méndez, Kelechi G. Kalu, James C. Davis

机构 * Purdue University(普渡大学)

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文通过实证研究比较了AI和人类在性能优化提交中的表现,发现AI提交在性能验证方面较人类不足,但优化模式与人类相似。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18802 2025-12-29 cs.MA cs.AI cs.SE 73%

Computational Foundations for Strategic Coopetition: Formalizing Interdependence and Complementarity

战略竞合的计算基础:形式化相互依赖与互补性

Vik Pant, Eric Yu

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 本报告提出计算基础,形式化竞合中的相互依赖与互补性,通过i*结构依赖分析和参数化建模,验证了竞合策略的动态权衡与价值获取。

Comments 39 pages, 9 figures, Validation artifacts including source code available at https://github.com/vikpant/strategic-coopetition/tree/master/TR_validation/TR1_foundations

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21440 2025-12-29 cs.SE cs.LG 73%

Fuzzwise: Intelligent Initial Corpus Generation for Fuzzing

Fuzzwise: 用于模糊测试的智能初始语料生成

Hridya Dhulipala, Xiaokai Rong, Aashish Yadavally, Tien N. Nguyen

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG、cs.SE

AI总结 FuzzWise通过基于LLM的多代理框架,高效生成初始语料,提升模糊测试的代码覆盖和错误触发效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07022 2025-12-09 cs.SE cs.AI cs.IR 73%

Reformulate, Retrieve, Localize: Agents for Repository-Level Bug Localization

重新表述、检索、局部化:用于仓库级缺陷定位的代理

Genevieve Caumartin, Glaucia Melo

机构 * Concordia University(康科迪亚大学) Toronto Metropolitan University(多伦多 Metropolitan 大学)

专题命中 软件智能体 :agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 本文提出利用LLM代理通过查询重新表述和摘要改进仓库级缺陷定位,实现更高效的文件级定位性能。

Comments Accepted at BoatSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02977 2025-12-04 cs.SE cs.AI 73%

Large Language Model-Based Agents for Software Engineering: A Survey

基于大型语言模型的软件工程代理:一项综述

Junwei Liu, Kaixin Wang, Yixuan Chen, Xin Peng, Zhenpeng Chen, Lingming Zhang, Yiling Lou

专题命中 软件智能体 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.SE

AI总结 本文综述了基于大型语言模型的软件工程代理,分析了其应用、挑战及未来方向。

Comments Accepted by TOSEM

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00371 2025-12-02 cs.GT cs.AI cs.LG cs.MA 73%

Evaluating LLMs in Open-Source Games

评估大型语言模型在开源游戏中的表现

Swadesh Sistla, Max Kleiman-Weiner

机构 * University of Washington(华盛顿大学)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文评估了LLMs在开源游戏中预测策略和分析合作策略形成的能力。

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16004 2025-11-21 cs.SE cs.AI 73%

InfCode: Adversarial Iterative Refinement of Tests and Patches for Reliable Software Issue Resolution

InfCode: 基于对抗的测试和补丁迭代精炼框架用于可靠的软件问题解决

KeFan Li, Mengfei Wang, Hengzhi Zhang, Zhichao Li, Yuan Yuan, Mu Li, Xiang Gao, Hailong Sun, Chunming Hu, Weifeng Lv

机构 * Beihang University(北航大学) Beijing Tokfinity Technology Co., Ltd.(北京 Tokfinity 技术有限公司)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 InfCode通过对抗多代理框架实现测试和补丁的迭代精炼,以提高软件问题解决的可靠性,实验表明其在SWE-bench Verified上达到79.4%的性能,创下了新的最先进水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03925 2025-11-07 cs.SE cs.AI 73%

Collaborative Agents for Automated Program Repair in Ruby

Nikta Akbarpour, Mahdieh Sadat Benis, Fatemeh Hendijani Fard, Ali Ouni, Mohamed Aymen Saied

机构 * University of British Columbia(不列颠哥伦比亚大学) Laval university(拉瓦尔大学)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21717 2025-10-28 cs.HC cs.AI cs.SE 73%

AI-Enhanced Operator Assistance for UNICOS Applications

Bernard Tam, Jean-Charles Tournier, Fernando Varela Rodriguez

机构 * The University of Sydney(悉尼大学)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

Comments Prepared as part of the CERN openlab programme 2025. Also available on Zenodo, a repository operated by CERN and co-funded by the European Union

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16059 2025-10-21 cs.SE cs.CL 73%

SIADAFIX: issue description response for adaptive program repair

Xin Cao, Nan Yu

机构 * Code Intelligence Team(代码智能团队) LI AUTO

专题命中 软件智能体 :agent(abstract);workflow(abstract);分类 cs.CL、cs.SE

Comments 20 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10010 2025-10-14 cs.SE cs.AI 73%

SLEAN: Simple Lightweight Ensemble Analysis Network for Multi-Provider LLM Coordination: Design, Implementation, and Vibe Coding Bug Investigation Case Study

Matheus J. T. Vargas

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

Comments 14 pages, 4 figures, 6 tables, link to code repo

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09049 2025-10-13 cs.AI cs.SE 73%

MEC$^3$O: Multi-Expert Consensus for Code Time Complexity Prediction

Joonghyuk Hahn, Soohan Lim, Yo-Sub Han

机构 * Department of Computer Science, Yonsei University(延世大学计算机科学系)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

Comments 24 pages, 11 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24260 2025-09-30 cs.SE cs.CL 73%

MaintainCoder: Maintainable Code Generation Under Dynamic Requirements

Zhengren Wang, Rui Ling, Chufan Wang, Yongan Yu, Sizhe Wang, Zhiyu Li, Feiyu Xiong, Wentao Zhang

机构 * Center for Data Science(数据科学中心) McGill University(麦吉尔大学) Center for LLM, Institute for Advanced Algorithms Research(大语言模型中心,先进算法研究所)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL、cs.SE

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18993 2025-09-16 cs.SE cs.AI 73%

GitTaskBench: A Benchmark for Code Agents Solving Real-World Tasks Through Code Repository Leveraging

Ziyi Ni, Huacan Wang, Shuo Zhang, Shuo Lu, Ziyang He, Wang You, Zhenheng Tang, Yuntao Du, Bill Sun, Hongzhang Liu, Sen Hu, Ronghao Chen, Bo Li, Xin Li, Chen Hu, Binxing Jiao, Daxin Jiang, Pin Lyu

机构 * UCAS(中国科学技术大学) CASIA(中国科学院自动化研究所) BUPT(北京理工大学) NUS(新加坡国立大学) StepFun HKUST(香港理工大学) SDU(山东大学) PINAI USYD(悉尼大学) PKU(北京大学) USTC(中国科学技术大学)

专题命中 软件智能体 :agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

Comments Highly practical, Well-motivated, Actionable

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00521 2025-09-16 cs.SE cs.AI 73%

Automated detection of atomicity violations in large-scale systems

Hang He, Yixing Luo, Chengcheng Wan, Ting Su, Haiying Sun, Geguang Pu

机构 * East China Normal University(华东师范大学) Beijing Institute of Control Engineering(北京控制工程研究所) East China Normal University Shanghai Innovation Institute(华东师范大学上海创新研究院)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20008 2025-09-01 cs.AI cs.PL cs.SE 73%

QHackBench: Benchmarking Large Language Models for Quantum Code Generation Using PennyLane Hackathon Challenges

Abdul Basit, Minghao Shao, Muhammad Haider Asif, Nouhaila Innan, Muhammad Kashif, Alberto Marchisio, Muhammad Shafique

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

Comments To appear at the IEEE International Conference on Quantum Artificial Intelligence (QAI), Naples, Italy, November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏