arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-26 至 2026-06-26 共收录 11 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 11 篇

2606.26721 2026-06-26 cs.SE cs.HC 新提交 88%

Knowledge-Based Pull Requests: A Trusted Workflow for Agent-Mediated Knowledge Collaboration

基于知识的拉取请求:一种可信的智能体中介知识协作工作流

Xinyu Zhang, Weiwei Sun

专题命中 软件智能体 :agent(title,abstract);workflow(title,abstract);分类 cs.SE

AI总结 提出知识型拉取请求(KPR)工作流,通过分离知识采纳与实现合并,利用智能体蒸馏外部知识并再生代码,以降低跨信任边界的软件协作成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26289 2026-06-26 cs.SE 新提交 83%

Augmentation with Dilution: A Large-Scale Empirical Study of Human Contributor Ecosystems After AI Coding Agent Adoption

稀释式增强:AI编码代理采纳后人类贡献者生态系统的大规模实证研究

Weixing Zhang, Bowen Jiang, Anne Koziolek

专题命中 软件智能体 :agent(title,abstract);AI agent(abstract);分类 cs.SE

AI总结 通过双重差分法分析11,097个GitHub仓库,发现AI编码代理采纳不改变人类贡献者绝对数量,但显著降低其密度,并减少新人参与份额,同时增加审查深度,揭示“稀释式增强”模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26300 2026-06-26 cs.AI cs.CL 新提交 81%

The Verification Horizon: No Silver Bullet for Coding Agent Rewards

验证地平线:编码智能体奖励没有银弹

Binghai Wang, Chenlong Zhang, Dayiheng Liu, Jiajun Zhang, Jiawei Chen, Mingze Li, Mouxiang Chen, Rongyao Fang, Siyuan Zhang, Xuwu Wang, Yuheng Jing, Zeyao Ma, Zeyu Cui

机构 * Qwen Team(Qwen团队)

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文指出,随着编码智能体能力增强,验证解决方案比生成更难,并沿可扩展性、忠实性和鲁棒性三个维度分析验证信号质量,通过四种奖励构建实验表明验证必须与生成器共同进化。

Comments Authors are listed alphabetically by their first names

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26525 2026-06-26 cs.LG cs.LO cs.PL 新提交 70%

Theory-Scale Auto-Formalization of Logics for Computer Science

计算机科学逻辑的理论级自动形式化

Yuming Feng, Frederick Pu, One An, Osbert Bastani, Li Zhang, Jiani Huang, Xujie Si, Ziyang Li

专题命中 软件智能体 :planning(abstract);agentic(abstract);分类 cs.LG

AI总结 提出LCS-Bench基准,通过半自动化流水线构建包含327个教材条目、4076个Lean声明的理论级自动形式化数据集,评估14个模型,发现最先进模型仅达20.1%准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01522 2026-06-26 cs.PL 版本更新 67%

Type-Error Ablation and AI Coding Agents

类型错误消融与AI编码代理

Shriram Krishnamurthi, Matthew Flatt

专题命中 软件智能体 :agent(abstract);AI agent(abstract)

AI总结 通过消融实验研究AI编码代理在修复类型错误时,更详细的错误消息是否比简洁消息更有效,并发现详细错误消息提升修复能力,类型系统比仅测试失败报告更有帮助。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27045 2026-06-26 cs.SE cs.AI 新提交 62%

The Spec Growth Engine: Spec-Anchored, Code-Coupled, Drift-Enforced Architecture for AI-Assisted Software Development

规范增长引擎:AI辅助软件开发的规范锚定、代码耦合、漂移强制架构

Hartwig Grabowski

机构 * Hochschule Offenburg(奥芬堡应用科学大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 提出规范增长引擎框架,通过机器可读的规范图、Spine上下文组装器、垂直切片增长协议和漂移门,解决AI编码代理中的上下文爆炸和规范-代码漂移问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26924 2026-06-26 cs.SE cs.AI cs.CR 新提交 62%

A Deterministic Control Plane for LLM Coding Agents

LLM编码代理的确定性控制平面

Padmaraj Madatha

机构 * Happiest Minds Technologies (AIP Centre of Excellence)(happiest minds technologies(aip中心卓越机构))

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 针对LLM编码代理配置缺乏管理的问题,提出确定性控制平面Rel(AI)Build,通过内容寻址、分层权限、阶段状态机等机制确保配置安全与一致性。

Comments 45 pages, 9 figures, 13 tables. Dataset and reproduction scripts: Zenodo DOI 10.5281/zenodo.20780913. Ancillary files include report.json, organizations.txt, and figure-reproduction scripts

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26978 2026-06-26 cs.SE 新提交 57%

To Run or Not to Run: Analyzing the Cost-Effectiveness of Code Execution in LLM-Based Program Repair

运行还是不运行:分析基于LLM的程序修复中代码执行的成本效益

Zhihao Lin, Junhua Zhu, Mingyi Zhou, Xin Wang, Zhensu Sun, Renyu Yang, David Lo, Li Li

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 通过分析SWE-bench上的代理轨迹和端到端修复尝试,发现代码执行在LLM程序修复中普遍使用但效益不均,限制执行可节省成本且不影响修复成功率。

Comments Accepted to the ACM SIGSOFT International Symposium on Software Testing and Analysis (ISSTA 2026). 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26578 2026-06-26 cs.AI 新提交 57%

EvoOptiGraph: Weakness-Driven Coevolution via Graph-Based Structural Generation for Optimization Modeling

EvoOptiGraph:基于图结构生成的弱点驱动协同进化优化建模

Qingcan Kang, Mingyang Liu, Xiaojin Fu, Shixiong Kai, Tao Zhong, Mingxuan Yuan

专题命中 软件智能体 :agentic(abstract);分类 cs.AI

AI总结 提出EvoOptiGraph框架,通过图结构表示混合整数线性规划并应用进化算子生成多样实例,结合监督微调和强化学习实现数据与模型的协同进化,显著提升优化建模的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27231 2026-06-26 quant-ph physics.ins-det 新提交 50%

A hardware-safety-gated system for LLM-written native ARTIQ control code on a trapped-ion platform

基于硬件安全门控的LLM编写原生ARTIQ控制代码系统在离子阱平台上的应用

Duanyang Wang, Lu Qi, Yuanheng Xie, Norbert M. Linke, Kenneth R. Brown

专题命中 软件智能体 :agent(abstract)

AI总结 提出一种硬件安全门控系统,通过令牌授权机制确保LLM代理在离子阱实验中安全自主地编写和执行控制代码,并在实验中验证了其有效性和可移植性。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.28197 2026-06-26 cs.RO cs.CV 版本更新 50%

OmniRobotHome: A Multi-Camera Home Platform for Real-Time Human-Robot Interaction

OmniRobotHome:一个多摄像头平台用于实时多对多人机交互

Junyoung Lee, Inhee Lee, Sookwan Han, Jeonghwan Kim, Kyungwon Cho, Mingi Choi, Lee Chae-Yeon, Wonjung Woo, Gunhee Kim, Jisoo Kim, Jeonghyeon Na, Hanbyul Joo

机构 * Seoul National University(首尔国立大学) RLWRLD

专题命中 软件智能体 :agent(abstract)

AI总结 OmniRobotHome通过多摄像头和双Franka机械臂实现多对多人机协作的实时3D感知与协同动作,解决了近距离交互中的遮挡和状态变化问题,为多对多协作实验提供了可行平台。

Comments Project Page: https://junc0ng.github.io/omnirobothome

详情

展开后加载摘要…

URL PDF HTML 收藏