arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-09 至 2026-04-09 共收录 11 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 11 篇

2604.06284 2026-04-09 cs.CR cs.AI 83%

ClawLess: A Security Model of AI Agents

ClawLess:AI代理的安全模型

Hongyi Lu, Nian Liu, Shuai Wang, Fengwei Zhang

机构 * Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系) Department of Computer Science and Engineering, Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系) Southern University of Science and Technology(南方科技大学) Hong Kong University of Science and Technology(香港科技大学)

专题命中 软件智能体 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 ClawLess提出一种形式化安全框架,通过在最坏情况威胁模型下强制验证策略,确保AI代理运行时的安全性,结合BPF技术实现动态策略的高效执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03926 2026-04-09 cs.AI cs.CY cs.HC cs.MA 83%

CODE-GEN: A Human-in-the-Loop RAG-Based Agentic AI System for Multiple-Choice Question Generation

CODE-GEN:一种基于检索增强生成的多选题生成人机协作人工智能系统

Xiaojing Duan, Frederick Nwanganga, Chaoli Wang

机构 * University of Notre Dame(圣母大学)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 CODE-GEN通过生成与课程目标一致的多选题提升学生代码推理能力,采用生成器和验证器代理,结合专用工具提高准确性,评估结果显示系统在七个教学维度上表现优异,但人类专家仍需参与设计教学性干扰项和反馈质量。

Comments Full version of the paper accepted as a short paper at the 27th International Conference on Artificial Intelligence in Education (AIED 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16206 2026-04-09 cs.CL cs.AI 81%

Computer Environments Elicit General Agentic Intelligence in LLMs

计算机环境在大语言模型中激发通用代理智能

Daixuan Cheng, Shaohan Huang, Yuxian Gu, Huatong Song, Guoxin Chen, Li Dong, Wayne Xin Zhao, Ji-Rong Wen, Furu Wei

机构 * GSAI, Renmin University of China(中国人民大学高瓴人工智能学院) Microsoft Research(微软研究院) Tsinghua University(清华大学)

专题命中 软件智能体 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文研究了计算机环境如何通过虚拟沙盒激发大语言模型的通用能力,展示了环境对任务解决的提升效果及训练方法。

Comments Project Page: https://llm-in-sandbox.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06241 2026-04-09 cs.CR 78%

ZitPit: Consumer-Side Admission Control for Agentic Software Intake

ZitPit:面向代理软件摄入的消费者侧准入控制

Jepson Taylor, Chris Brousseau, Jordan Hildebrandt, Kelli Quinn

专题命中 软件智能体 :agentic(title,abstract)

AI总结 ZitPit通过严格边界控制,确保首次见到的外部工件成为持久政策事件,统一了工件准入、仓库开放状态、能力范围执行和持久政策记录,提升代理工作流的安全性。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03460 2026-04-09 physics.chem-ph physics.comp-ph 78%

FermiLink: A Unified Agent Framework for Multidomain Autonomous Scientific Simulations

FermiLink:一个多领域自主科学模拟的统一代理框架

Gang Meng, Andres Felipe Bocanegra Vargas, Xinwei Ji, Federico Garcia-Gaitan, Felipe Reyes-Osorio, Jalil Varela-Manjarres, Yafei Ren, Mohammadhasan Dinpajooh, Branislav K. Nikolić, Tao E. Li

专题命中 软件智能体 :agent(title,abstract)

AI总结 FermiLink通过分离知识库与模拟工作流,实现多领域科学模拟的统一框架,能高效复现74%的科学图表并生成高质量研究成果。

Comments Simulation data available at https://www.taoeli.org/publications; source code available at Github https://github.com/TaoELi/FermiLink

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18341 2026-04-09 cs.SE 74%

Agentic Much? Adoption of Coding Agents on GitHub

代理那么多?GitHub上编码代理的采用情况

Romain Robbes, Théo Matricon, Thomas Degueule, Andre Hora, Stefano Zacchiroli

专题命中 软件智能体 :agentic(title);分类 cs.SE

AI总结 研究探讨了编码代理在GitHub上的采用情况,发现其采用率高达22.20%-28.66%,且在项目成熟度、组织类型和编程语言上均广泛适用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06793 2026-04-09 cs.SE cs.AI 62%

Evaluating Repository-level Software Documentation via Question Answering and Feature-Driven Development

通过问答和基于特征的开发评估仓库级软件文档

Xinchen Wang, Ruida Hu, Cuiyun Gao, Pengfei Gao, Chao Peng

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Independent Researcher, China(独立研究者)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出SWD-Bench基准,通过功能驱动的问答任务评估仓库级文档质量,揭示现有方法局限,并展示高质量文档对SWE-Agent问题解决率的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06603 2026-04-09 cs.CL cs.AI 62%

Scientific Knowledge-driven Decoding Constraints Improving the Reliability of LLMs

基于科学知识的解码约束:提升大语言模型的可靠性

Maotian Ma, Zheni Zeng, Zhenghao Liu, Yukun Yan

机构 * Nanjing University(南京大学) Tsinghua University(清华大学) Northeastern University(东北大学)

专题命中 软件智能体 :planning(abstract);分类 cs.AI、cs.CL

AI总结 本文提出SciDC方法,通过整合领域知识与强约束提升LLM在科学任务中的可靠性,实验显示在工业配方设计、肿瘤诊断和逆合成规划中平均准确率提升12%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06373 2026-04-09 cs.SE cs.AI 62%

Beyond Functional Correctness: Design Issues in AI IDE-Generated Large-Scale Projects

超越功能性正确性:AI IDE生成大规模项目的 设计问题

Syed Mohammad Kashif, Ruiyin Li, Peng Liang, Amjed Tahir, Qiong Feng, Zengyang Li, Mojtaba Shahin

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) School of Mathematical and Computational Sciences, Massey University(梅西大学数学与计算科学学院) School of Computer Science, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) School of Computer Science, Central China Normal University(华中师范大学计算机学院) School of Computing Technologies, RMIT University(RMIT大学计算技术学院)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文研究了AI IDE生成大规模项目的功能正确性和设计问题,通过FD-HITL框架生成10个项目,发现存在大量设计缺陷,需专业开发者审查。

Comments 40 pages, 19 images, 5 tables, Manuscript submitted to a Journal (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07304 2026-04-09 cs.SE cs.AI 62%

Chatbot-Based Assessment of Code Understanding in Automated Programming Assessment Systems

基于聊天机器人的代码理解评估在自动化编程评估系统中的应用

Eduard Frankford, Erik Cikalleshi, Ruth Breu

机构 * University of Innsbruck(因斯布鲁克大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文探讨了聊天机器人在自动化编程评估中的应用,提出混合苏格拉底框架以整合对话验证,解决代码理解评估中的挑战。

Comments 12 pages, accepted for publication at CSEDU 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06861 2026-04-09 cs.SE 57%

REAgent: Requirement-Driven LLM Agents for Software Issue Resolution

REAgent:基于需求的LLM代理用于软件问题解决

Shiqi Kuang, Zhao Tian, Kaiwei Lin, Chaofan Tao, Shaowei Wang, Haoli Bai, Lifeng Shang, Junjie Chen

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 本文提出REAgent框架,通过引入问题导向的需求作为结构化任务规范,提升补丁生成准确性,实验表明其在问题解决率上平均提升17.40%。

详情

展开后加载摘要…

URL PDF HTML 收藏