arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-05-13 至 2026-05-13 共收录 11 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 11 篇

2605.11229 2026-05-13 cs.CR cs.AI cs.SE 86%

Comment and Control: Hijacking Agentic Workflows via Context-Grounded Evolution

评论与控制:通过上下文引导进化劫持代理工作流

Neil Fendley, Zhengyu Liu, Aonan Guan, Jiacheng Zhong, Yinzhi Cao

机构 * Johns Hopkins University Applied Physics Lab(约翰霍普金斯大学应用物理实验室) Johns Hopkins University(约翰霍普金斯大学) Wyze Labs(Wyze实验室)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 本文提出JAW框架,通过上下文引导进化方法劫持自动化平台上的代理工作流,揭示代理工作流中因输入操控导致的安全风险,并展示了对GitHub和n8n的广泛影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11027 2026-05-13 cs.SE cs.AI 84%

From Code-Centric to Intent-Centric Software Engineering: A Reflexive Thematic Analysis of Generative AI, Agentic Systems, and Engineering Accountability

从代码导向到意图导向的软件工程:生成式人工智能、代理系统和工程问责的反思主题分析

Elyson De La Cruz

机构 * University of the Cumberlands(卡姆伯兰大学)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 本文通过反思性主题分析和解释现象学分析,探讨生成式人工智能、代理系统如何推动软件工程从代码导向转向意图导向,强调意图指定、上下文整理、架构知识和问责的重要性。

Comments 24 pages, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08083 2026-05-13 cs.CL 79%

LLMs Improving LLMs: Agentic Discovery for Test-Time Scaling

LLMs改进LLMs:测试时扩展的代理发现

Tong Zheng, Haolin Liu, Chengsong Huang, Huiwen Bao, Sheng Zhang, Rui Liu, Runpeng Dai, Ruibo Chen, Chenxi Liu, Tianyi Xiong, Xidong Wu, Hongming Zhang, Heng Huang

机构 * UMD(马里兰大学) UVA(弗吉尼亚大学) WUSTL(华盛顿大学) UNC(北卡罗来纳大学) Google(谷歌) Meta

专题命中 软件智能体 :agentic(title);agent(abstract);分类 cs.CL

AI总结 本文提出AutoTTS框架,通过环境驱动的方法自动发现测试时扩展策略,提升大语言模型性能,实验表明其在数学推理基准上的准确率与成本平衡优于人工设计基线。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11442 2026-05-13 cs.CR cs.AI cs.CL 79%

Can a Single Message Paralyze the AI Infrastructure? The Rise of AbO-DDoS Attacks through Targeted Mobius Injection

单条消息能否瘫痪AI基础设施?通过针对性Mobius注入的AbO-DDoS攻击崛起

Zi Liang, Ronghua Li, Yanyun Wang, Qingqing Ye, Haibo Hu

机构 * The Hong Kong Polytechnic University(香港理工大学) HKUST (GZ)(香港科技大学(广州))

专题命中 软件智能体 :agent(abstract);autonomous agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 研究揭示了通过Mobius注入攻击利用代理逻辑中的语义闭合漏洞,实现对AI基础设施的隐蔽攻击,展示了攻击的轻量、隐蔽性和高配置性,并提出基于组件能量分析的防御机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07001 2026-05-13 cs.SE cs.CL 62%

SmellBench: Evaluating LLM Agents on Architectural Code Smell Repair

SmellBench:评估LLM代理在建筑代码异味修复上的表现

Ion George Dinu, Marian Cristian Mihăescu, Traian Rebedea

机构 * University of Craiova(克劳索瓦大学) NVIDIA(NVIDIA公司) University Politehnica of Bucharest(布加勒斯特理工大学)

专题命中 软件智能体 :agent(abstract);分类 cs.CL、cs.SE

AI总结 本文提出SmellBench框架,用于评估LLM代理在修复建筑代码异味方面的性能,通过专家验证发现最佳代理修复率为47.7%,但修复 aggressiveness 与代码库质量呈负相关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11720 2026-05-13 cs.SE cs.AI cs.MA 62%

A Research Agenda on Agents and Software Engineering: Outcomes from the Rio A2SE Seminar

关于智能体与软件工程的研究议程:来自里约A2SE研讨会的成果

Davide Taibi, Henry Muccini, Karthik Vaidhyanathan, Marcos Kalinowski, Michele Albano, Antonio Pedro Santos Alves, Renato Cerqueira, Mateus Devino, Matteo Esposito, Rodrigo Falcão, Vinicius Henning, Foutse Khomh, Valentina Lenarduzzi, Qinghua Lu, Matías Martínez, Henrique Mello, Daniel Mendez, Lucas Romao

机构 * University of Southern Denmark(丹麦南方大学) Software Engineering Research Center, IIIT Hyderabad(IIIT海得拉巴软件工程研究中心) Pontifical Catholic University of Rio de Janeiro(里约热内卢天主教大学)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文基于智能体AI的兴起,探讨其对软件工程的影响,提出六个主题领域及短期和长期研究方向,为软件工程社区提供协调努力的结构化基础。

Comments 6 pages, 1 table, A2SE meeting, https://sites.google.com/view/a2se2026/home

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12366 2026-05-13 cs.AI 57%

Classifier Context Rot: Monitor Performance Degrades with Context Length

分类器上下文旋转:通过上下文长度监控性能退化

Sam Martin, Fabien Roger

机构 * Anthropic Fellows Program(Anthropic fellows项目)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 研究发现当前前沿模型在长上下文情况下难以检测危险行为,通过提示技术可部分缓解此问题,强调长上下文退化对监控性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12275 2026-05-13 cs.SE cs.PL 57%

Minimalistic Terminal Editor for Julia Programming -- MinTEJ: A Friendly Approach for a Scientific Programmer

为Julia编程语言设计的极简终端编辑器--MinTEJ:面向科学程序员的友好方法

Poornachandratejasvi Laxman Bhattar, Payal V. Dahiwale, Krishnarjunulu Thota, Anurag Sharma

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 本文提出MinTEJ,一种基于终端的Julia编辑器,采用顺序模式交互架构,整合文件管理、代码编辑、执行和调试,降低认知负荷和错误率。

Comments 15 Pages, 42 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11269 2026-05-13 gr-qc astro-ph.HE astro-ph.IM cs.AI 57%

gwBenchmarks: Stress-Testing LLM Agents on High-Precision Gravitational Wave Astronomy

gwBenchmarks: 对高精度引力波天文学中LLM代理的应力测试

Tousif Islam, Digvijay Wadekar, Zihan Zhou

机构 * Kavli Institute for Theoretical Physics, University of California Santa Barbara, Kohn Hall, Lagoon Rd, Santa Barbara, CA 93106(加州大学圣芭芭拉分校凯弗利理论物理研究所) Center for Gravitational Physics, University of Texas at Austin, Austin, TX 78712, USA(德克萨斯大学奥斯汀分校引力物理中心) Department of Physics, Princeton University, Princeton, NJ 08540, USA(普林斯顿大学物理系)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 本文研究了最先进的LLM编码代理能否完成端到端的科学建模任务,通过八个任务测试其精度和物理系统推理能力,发现代理在复杂任务上表现不佳,无法达到领域要求。

Comments 26 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12059 2026-05-13 cs.HC cs.RO 50%

RoboBlockly Studio: Conversational Block Programming with Embodied Robot Feedback for Computational Thinking

RoboBlockly Studio:具有身体反馈的对话式积木编程用于计算思维

Leyi Li, Chenyu Du, Jiafei Sun, Erick Purwanto, Qing Zhang

机构 * Xi'an Jiaotong-Liverpool University(西安交通大学利物浦大学)

专题命中 软件智能体 :agent(abstract)

AI总结 本文提出RoboBlockly Studio,结合积木编程、对话AI教学代理和具身机器人执行,通过迭代循环提升学生计算思维能力,探讨AI与机器人在教育中的应用。

Comments Accepted to ACM DIS 2026. Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11495 2026-05-13 cs.HC 50%

Hedwig: Dynamic Autonomy for Coding Agents Under Local Oversight

Hedwig:在局部监督下编码代理的动态自主性

Tanjal Shukla, K. J. Kevin Feng, Leijie Wang, Mohammad Rostami, Amy X. Zhang

专题命中 软件智能体 :agent(abstract)

AI总结 Hedwig通过动态调整自主性水平,减少开发者与编码代理协作中的摩擦,提升任务执行效率。

Comments accepted to ACM CAIS 2026 demo track

详情

展开后加载摘要…

URL PDF HTML 收藏