arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 3224 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 3224 篇

2601.13754 2026-01-21 cs.SE 57%

On Autopilot? An Empirical Study of Human-AI Teaming and Review Practices in Open Source

自动驾驶?开源软件中人类与AI协作及审查实践的实证研究

Haoyu Gao, Peerachai Banyongrakkul, Hao Guan, Mansooreh Zahedi, Christoph Treude

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 本研究通过分析开源项目中AI辅助PR的互动模式,发现非所有权贡献者提交的AI共同撰写的PR被快速合并且反馈极少,揭示了AI在软件工程中的协作与审查实践问题。

Comments accepted as MSR short paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11510 2026-01-19 cs.LO cs.SE 57%

Applying Formal Methods Tools to an Electronic Warfare Codebase (Experience report)

将形式方法工具应用于电子战代码库(经验报告)

Letitia W. Li, Denley Lam, Vu Le, Daniel Mitchell, Mark J. Gerken, Robert B. Ross

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 本文报告了将形式方法工具应用于电子战系统中的经验,探讨了工具可用性及漏洞检测比较,并提出改进建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09921 2026-01-16 quant-ph cs.AI 57%

Learning to Decode in Parallel: Self-Coordinating Neural Network for Real-Time Quantum Error Correction

并行解码学习:用于实时量子错误校正的自协调神经网络

Kai Zhang, Zhengzhong Yi, Shaojun Guo, Linghang Kong, Situ Wang, Xiaoyu Zhan, Tan He, Weiping Lin, Tao Jiang, Dongxin Gao, Yiming Zhang, Fangming Liu, Fang Zhang, Zhengfeng Ji, Fusheng Chen, Jianxin Chen

机构 * Zhongguancun Laboratory(中关村实验室) Pengcheng Laboratory(鹏城实验室)

专题命中 软件智能体 :workflow(abstract);分类 cs.AI

AI总结 本文提出了一种自协调神经网络,用于实时量子错误校正,实现了高精度并行解码,突破了传统解码器的吞吐量瓶颈。

Comments The main text consists of 25 pages and 9 figures, extending our prior work (arXiv:2509.03815) with new results on surface code decoding in superconducting qubit systems and real-time performance benchmarks on TPU v6e

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23675 2026-01-15 cs.CR cs.AI 57%

QueryIPI: Query-agnostic Indirect Prompt Injection on Coding Agents

QueryIPI: 针对编码代理的查询无关间接提示注入

Yuchong Xie, Zesen Liu, Mingyu Luo, Zhixiang Zhang, Kaikai Zhang, Yuanyuan Yuan, Zongjie Li, Ping Chen, Shuai Wang, Dongdong She

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Fudan University(复旦大学) Tsinghua University(清华大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 QueryIPI通过利用系统不变性与工具描述,实现对编码代理的查询无关间接提示注入,实验显示其在模拟代理中达到87%的成功率,揭示了现实中的安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04124 2026-01-13 cs.SE 57%

Smells Depend on the Context: An Interview Study of Issue Tracking Problems and Smells in Practice

气味取决于上下文:关于问题跟踪问题和实践中气味的访谈研究

Lloyd Montgomery, Clara Lüders, Christian Rahe, Walid Maalej

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 本文通过访谈研究,探讨了问题跟踪系统中问题和气味的上下文依赖性,揭示了团队在实际工作中遇到的挑战及潜在的工具解决方案。

Comments 30 pages, 1 figure, accepted at the ACM TOSEM journal. arXiv admin note: substantial text overlap with arXiv:2507.06704

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03878 2026-01-08 cs.SE 57%

Understanding Specification-Driven Code Generation with LLMs: An Empirical Study Design

通过LLM理解基于规范的代码生成:一项实证研究设计

Giovanni Rosa, David Moreno-Lumbreras, Gregorio Robles, Jesús M. González-Barahona

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 本文通过实证研究设计,探讨人类干预在基于规范的LLM代码生成过程中对代码质量和动态的影响。

Comments This paper is a Stage 1 Registered Report. The study protocol and analysis plan were peer reviewed and accepted at SANER 2026 with a Continuity Acceptance (CA) score for Stage 2

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09280 2026-01-07 cs.DC cs.LG cs.NA math.NA 57%

TTrace: Lightweight Error Checking and Diagnosis for Distributed Training

TTrace: 轻量级的分布式训练错误检查与诊断

Haitian Jiang, Shaowei Zhu, Zhen Zhang, Zhenyu Song, Xinwei Fu, Zhen Jia, Yida Wang, Jinyang Li

机构 * New York University(纽约大学) Amazon Web Services(亚马逊网络服务)

专题命中 软件智能体 :workflow(abstract);分类 cs.LG

AI总结 TTrace通过系统性的差分测试方法,有效检测和定位分布式训练中的无声bug,提升调试效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01964 2026-01-06 cs.CL 57%

CSF: Contrastive Semantic Features for Direct Multilingual Sign Language Generation

CSF:对比语义特征用于直接多语言手语生成

Tran Sy Bao

专题命中 软件智能体 :agent(abstract);分类 cs.CL

AI总结 CSF通过九个通用语义槽和综合条件分类法,实现无需英语中介的多语言手语直接生成,提升聋人社区的交流无障碍性。

Comments 9 pages, 8 tables, code available at https://github.com/transybao1393/csf-sign-language

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01850 2026-01-06 cs.LG cs.RO 57%

ManiBox: Enhancing Embodied Spatial Generalization via Scalable Simulation Data Generations

ManiBox: 通过可扩展的模拟数据生成增强具身空间泛化

Hengkai Tan, Xuezhou Xu, Chengyang Ying, Xinyi Mao, Zeyuan Wang, Songming Liu, Xingxing Zhang, Zhizhong Su, Hang Su, Jun Zhu

机构 * Tsinghua University(清华大学) National University of Singapore(新加坡国立大学) Horizon Robotics

专题命中 软件智能体 :agent(abstract);分类 cs.LG

AI总结 ManiBox通过可扩展的模拟数据生成提升具身智能体的空间泛化能力,有效减少仿真到现实的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00509 2026-01-05 cs.CR cs.LG 57%

Improving LLM-Assisted Secure Code Generation through Retrieval-Augmented-Generation and Multi-Tool Feedback

通过检索增强生成和多工具反馈改进LLM辅助的安全代码生成

Vidyut Sriram, Sawan Pandita, Achintya Lakshmanan, Aneesh Shamraj, Suman Saha

机构 * Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 软件智能体 :workflow(abstract);分类 cs.LG

AI总结 通过检索增强生成和多工具反馈,改进LLM辅助的安全代码生成,显著减少安全漏洞和缺陷率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22469 2025-12-30 cs.SE 57%

GraphLocator: Graph-guided Causal Reasoning for Issue Localization

GraphLocator: 图引导的因果推理用于问题定位

Wei Liu, Chao Peng, Pengfei Gao, Aofan Liu, Wei Zhang, Haiyan Zhao, Zhi Jin

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 GraphLocator通过因果图发现和动态解构解决软件问题定位中的因果不匹配和一对一不匹配问题,提升定位准确性和下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21450 2025-12-29 cs.LG 57%

RLLaVA: An RL-central Framework for Language and Vision Assistants

RLLaVA: 一种面向语言和视觉助手的强化学习中心框架

Lei Zhao, Zihao Ma, Boyu Lin, Yuhe Liu, Wenjun Wu, Lei Huang

机构 * SKLCCSE, Institute of Artificial Intelligence, Beihang University, Beijing, China(信息与电子技术学院,人工智能研究院,北京航空航天大学,北京,中国) Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, Beihang University(未来区块链与隐私计算先进创新中心,北京航空航天大学) Hangzhou International Innovation Institute, Beihang University, Hangzhou, China(杭州国际创新研究院,北京航空航天大学,杭州,中国)

专题命中 软件智能体 :agentic(abstract);分类 cs.LG

AI总结 RLLaVA 提出了一种强化学习中心框架,通过解耦算法逻辑与模型架构,实现高效训练和多任务扩展,提升视觉-语言模型性能。

Comments The code is available at https://github.com/TinyLoopX/RLLaVA

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21426 2025-12-29 cs.SE 57%

What Makes a GitHub Issue Ready for Copilot?

什么让 GitHub 问题适合 Copilot?

Mohammed Sayagh

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 本文提出32条准则,通过可解释机器学习模型评估GitHub问题质量,提升Copilot合并拉取请求的可能性,模型中位AUC达72%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21878 2025-12-24 cs.SE cs.PL 57%

Advancing Automated In-Isolation Validation in Repository-Level Code Translation

在仓库级代码翻译中推进自动化独立验证

Kaiyao Ke, Ali Reza Ibrahimzada, Rangeet Pan, Saurabh Sinha, Reyhaneh Jabbarvand

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 TRAM通过结合上下文感知的类型解析与基于模拟的独立验证,实现了高质量的编程语言间翻译,尤其在Java到Python的翻译中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16965 2025-12-22 cs.CR cs.SE 57%

AutoDFBench 1.0: A Benchmarking Framework for Digital Forensic Tool Testing and Generated Code Evaluation

AutoDFBench 1.0:数字取证工具测试和生成代码评估的基准框架

Akila Wickramasekara, Tharusha Mihiranga, Aruna Withanage, Buddhima Weerasinghe, Frank Breitinger, John Sheppard, Mark Scanlon

专题命中 软件智能体 :agentic(abstract);分类 cs.SE

AI总结 AutoDFBench 1.0 提出了一种统一的自动化基准框架,用于评估数字取证工具、脚本及AI生成代码,通过标准化指标实现工具间的公平比较和可重复验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.06890 2025-12-19 cs.LG stat.ML 57%

Learning-Driven Exploration for Reinforcement Learning

基于学习的探索用于强化学习

Muhammad Usama, Dong Eui Chang

专题命中 软件智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出基于熵的探索方法,通过自适应探索状态空间未探索区域,提升强化学习的效率和学习速度。

Journal ref 2021 21st International Conference on Control, Automation and Systems (ICCAS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19972 2025-12-15 cs.RO cs.AI 57%

An effective control of large systems of active particles: An application to evacuation problem

大规模活性粒子系统的有效控制:应用于疏散问题的应用

Albina Klepach, Egor E. Nuzhin, Alexey A. Tsukanov, Nikolay V. Brilliantov

机构 * AIRI Artificial Intelligence Center, Skolkovo Institute of Science and Technology(人工智能中心,斯克洛夫科技研究所) Department of Mathematics, University of Leicester(数学系,莱斯特大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出一种结合强化学习与人工力的控制策略,用于机器人救援者高效疏散人群,克服了传统方法的可扩展性和鲁棒性不足问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03420 2025-12-12 cs.CR cs.SE 57%

HarnessAgent: Scaling Automatic Fuzzing Harness Construction with Tool-Augmented LLM Pipelines

HarnessAgent:利用工具增强的LLM流水线实现自动模糊测试Harness构建的扩展

Kang Yang, Yunhang Zhang, Zichuan Li, Guanhong Tao, Jun Xu, Xiaojing Liao

专题命中 软件智能体 :agentic(abstract);分类 cs.SE

AI总结 HarnessAgent通过工具增强的LLM流水线实现全自动、可扩展的模糊测试Harness构建,提升生成成功率和代码检索效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09679 2025-12-11 cs.SE 57%

Understanding Chain-of-Thought Effectiveness in Code Generation: An Empirical and Information-Theoretic Analysis

理解链式思维在代码生成中的有效性:一项经验性与信息论分析

Naizhu Jin, Zhong Li, Guang Yang, Tian Zhang, Qingkai Zeng

专题命中 软件智能体 :planning(abstract);分类 cs.SE

AI总结 本研究通过经验分析和信息论方法,揭示了链式思维在代码生成中有效性的影响因素,发现结构化CoT在提升生成质量方面表现更优,且其效果受语言系统和模型容量影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07302 2025-12-09 cs.CV cs.AI 57%

Towards Accurate UAV Image Perception: Guiding Vision-Language Models with Stronger Task Prompts

迈向准确的无人机图像感知:通过更强的任务提示引导视觉-语言模型

Mingning Guo, Mengwei Wu, Shaoxian Li, Haifeng Li, Chao Tao

机构 * School of Geosciences and InfoPhysics, Central South University(地质科学与信息物理学院,中南大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 AerialVP通过增强任务提示提升无人机图像感知性能,引入AerialSense基准评估模型在复杂场景下的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23749 2025-12-05 cs.SE 57%

A Survey of LLM-based Automated Program Repair: Taxonomies, Design Paradigms, and Applications

基于大型语言模型的自动程序修复综述:分类、设计范式与应用

Boyang Yang, Zijian Cai, Fengling Liu, Bach Le, Lingming Zhang, Tegawendé F. Bissyandé, Yang Liu, Haoye Tian

专题命中 软件智能体 :agentic(abstract);分类 cs.SE

AI总结 本文综述了基于LLM的自动程序修复,提出统一分类法,涵盖四种范式,并讨论了评估实践和未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23302 2025-12-01 cs.SE 57%

FLIMs: Fault Localization Interference Mutants, Definition, Recognition and Mitigation

FLIMs: 故障定位干扰突变体,定义、识别与缓解

Hengyuan Liu, Zheng Li, Donghua Wang, Yankai Wu, Xiang Chen, Yong Liu

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 本文提出MBFL-FLIM框架,通过识别和缓解干扰突变体提升故障定位效果,实验证明其在多故障场景中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03187 2025-12-01 cs.LG cs.RO 57%

Periodic Skill Discovery

周期性技能发现

Jonghae Park, Daesol Cho, Jusuk Lee, Dongseok Shim, Inkyu Jang, H. Jin Kim

专题命中 软件智能体 :agent(abstract);分类 cs.LG

AI总结 周期性技能发现(PSD)通过无监督学习发现具有不同周期的技能,提升复杂机器人任务中的表现和多样性。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14169 2025-11-25 cs.CV cs.AI 57%

AdaTok: Adaptive Token Compression with Object-Aware Representations for Efficient Multimodal LLMs

AdaTok: 一种基于对象感知表示的自适应令牌压缩方法,用于高效多模态大语言模型

Xinliang Zhang, Lei Zhu, Hangzhou He, Shuang Zeng, Ourui Fu, Jiakui Hu, Zhengjian Yao, Yanye Lu

机构 * Institute of Medical Technology, Peking University Health Science Center(北京大学医学部医学技术研究所) Department of Biomedical Engineering, Peking University(北京大学生物医学工程系) National Biomedical Imaging Center, Peking University(北京大学国家生物医学成像中心)

专题命中 软件智能体 :workflow(abstract);分类 cs.AI

AI总结 AdaTok通过自适应令牌压缩方法,利用对象感知表示提升多模态大语言模型的效率,实现高压缩比与高性能的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18300 2025-11-20 cs.AI 57%

CompetEvo: Towards Morphological Evolution from Competition

Kangyao Huang, Di Guo, Xinyu Zhang, Xiangyang Ji, Huaping Liu

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) School of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院) School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动性学院) Department of Automation, Tsinghua University(清华大学自动化系)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15980 2025-11-17 cs.HC cs.AI cs.DB 57%

Text-to-SQL Domain Adaptation via Human-LLM Collaborative Data Annotation

Yuan Tian, Daniel Lee, Fei Wu, Tung Mai, Kun Qian, Siddhartha Sahai, Tianyi Zhang, Yunyao Li

机构 * Purdue University(普渡大学) Adobe Inc.(Adobe公司)

专题命中 软件智能体 :workflow(abstract);分类 cs.AI

Comments Accepted by IUI'25 Code & Demo: https://github.com/magic-YuanTian/SQLsynth

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03768 2025-11-12 cs.LG 57%

ORVIT: Near-Optimal Online Distributionally Robust Reinforcement Learning

Debamita Ghosh, George K. Atia, Yue Wang

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) Department of Computer Science(计算机科学系) University of Central Florida(中央佛罗里达大学)

专题命中 软件智能体 :agent(abstract);分类 cs.LG

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19405 2025-11-11 cs.AI 57%

Logic Distillation: Learning from Code Function by Function for Decision-making Tasks

Dong Chen, Shilin Zhang, Fei Gao, Yueting Zhuang, Siliang Tang, Qidong Liu, Mingliang Xu

机构 * The School of Computer and Artificial Intelligence of Zhengzhou University(郑州大学计算机与人工智能学院) Engineering Research Center of Intelligent Swarm Systems, Ministry of Education(教育部智能群体系统工程研究中心) National Supercomputing Center In Zhengzhou(郑州国家超级计算中心) Zhejiang University(浙江大学)

专题命中 软件智能体 :planning(abstract);分类 cs.AI

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03586 2025-11-06 cs.PF cs.AI 57%

PerfDojo: Automated ML Library Generation for Heterogeneous Architectures

Andrei Ivanov, Siyuan Shen, Gioele Gottardo, Marcin Chrapek, Afif Boudaoud, Timo Schneider, Luca Benini, Torsten Hoefler

机构 * ETH Zurich(苏黎世联邦理工学院)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

Journal ref The International Conference for High Performance Computing, Networking, Storage and Analysis (SC '25), November 16--21, 2025, St Louis, MO, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01183 2025-11-05 cs.AI cs.PL 57%

QiMeng-NeuComBack: Self-Evolving Translation from IR to Assembly Code

Hainan Fang, Yuanbo Wen, Jun Bi, Yihan Wang, Tonghui He, Yanlin Tang, Di Huang, Jiaming Guo, Rui Zhang, Qi Guo, Yunji Chen

机构 * State Key Lab of Processors, Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(中国科学院计算技术研究所处理器重点实验室,北京,中国) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国)

专题命中 软件智能体 :workflow(abstract);分类 cs.AI

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏