arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-05-28 至 2026-05-28 共收录 7 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 7 篇

2605.26186 2026-05-28 cs.SE cs.AI cs.CL cs.LG 83%

SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?

SetupX:LLM代理能否从过去的功能正确代码仓库设置失败中学习?

Zihang Zhou, Ziqian Ren, Yukai Wu, Yingjie Xiong, Wei Zhou, Chao Peng, Dong Zhang, Bingheng Yan, Xuanhe Zhou, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing University of Posts and Telecommunications(北京邮电大学) Independent Researcher(独立研究者) Jinan Inspur Data Technology Co., Ltd.(济南 Inspur 数据技术有限公司)

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 提出SetupX框架,通过经验学习、推测执行和验证协议解决代码仓库设置中的跨仓库经验迁移、多步试错和鲁棒验证问题,在基准测试中达到92%通过率。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28583 2026-05-28 cs.RO cs.AI cs.LG cs.SY eess.SY 62%

SARAD: LLM-Based Safety-Aware Hybrid Reinforcement Learning with Collision Prediction for Autonomous Driving

SARAD:基于LLM的安全感知混合强化学习与碰撞预测在自动驾驶中的应用

Kangyu Wu, Peng Cui, Guoxi Chen, Ya Zhang

机构 * National Natural Science Foundation (NNSF) of China(中国国家自然科学基金委员会) National Science and Major Project(国家科学技术重大专项)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 提出SARAD框架,结合大语言模型和深度强化学习,通过检索增强生成和碰撞预测模块提升自动驾驶的安全性和效率。

Comments 7 pages, 4 figures, accepted by IJCNN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25781 2026-05-28 cs.LG cs.AI cs.NA cs.NE math.NA 62%

A Practitioner's Guide to Kolmogorov-Arnold Networks

Kolmogorov-Arnold网络实践指南

Amir Noorizadegan, Sifan Wang, Leevan Ling, Juan P. Dominguez-Morales

机构 * Department of Mathematics, Hong Kong Baptist University(香港 Baptist大学数学系) Institution for Foundations of Data Science, Yale University(数据科学基础研究所,耶鲁大学) Robotics and Technology of Computers Lab., Universidad de Sevilla(机器人与计算机技术实验室,塞维利亚大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 本文系统综述了受Kolmogorov叠加定理启发的KAN网络,从理论基础、设计轴心(基函数)到最新进展,并提供了实用选择指南和未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11896 2026-05-28 cs.CR cs.AI cs.SE 62%

VULPO: Context-Aware Vulnerability Detection via On-Policy LLM Optimization

VULPO:基于策略优化的上下文感知漏洞检测

Youpeng Li, Fuxun Yu, Weiliang Qi, Xinda Wang

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校) Microsoft(微软)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI

AI总结 提出VULPO框架,通过构建包含上下文信息和推理轨迹的数据集ContextVul,结合冷启动监督微调和自适应策略优化,显著提升大语言模型在真实仓库中的漏洞检测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28282 2026-05-28 cs.AI 57%

ResearchLoop: An Evidence-Gated Control Plane for AI-Assisted Research

ResearchLoop: 一种用于AI辅助研究的证据门控控制平面

Yihan Xia, Taotao Wang

机构 * Shenzhen University(深圳大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 提出ResearchLoop,一种通过证据门控控制平面来确保AI辅助研究中声明可审计的协议,包括状态模型、转换规则和实验验证。

Comments 32 pages, 4 figures, 6 tables; technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27399 2026-05-28 cs.CY cs.AI 57%

Short-Term Gain, Long-Term Fragility: AI Labor Substitution and the Erosion of Sustainable Capability

短期收益,长期脆弱:AI劳动力替代与可持续能力的侵蚀

Wolfgang Rohde

机构 * AiSuNe Foundation(AiSuNe基金会)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文提出能力掩盖与能力侵蚀机制,论证AI劳动力替代在短期内提升效率的同时,通过消耗难以重建的人力能力导致系统长期脆弱性增加。

Comments 19 pages, 7 figures, Also available on SSRN: https://doi.org/10.2139/ssrn.6577818

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27667 2026-05-28 cs.CR 50%

Silent Consent, Persistent Risk: Android Permission Groups and Custom Permissions

沉默的同意,持续的风险:Android权限组与自定义权限

Olawale Amos Akanji, Manuel Egele, Gianluca Stringhini

专题命中 仓库级理解 :repository(abstract)

AI总结 通过分析1930万APK和Android 16设备验证,揭示权限组自动授予新权限和正常级自定义权限静默安装的机制导致17%的多版本应用在已授权组内静默获得权限,且恶意软件比例更高(OR=1.35),并发现307个跨开发者自定义权限对暴露敏感数据。

Comments 24 pages, 3 figures, 6 tables. To appear in the Proceedings of the 23rd Conference on Detection of Intrusions and Malware & Vulnerability Assessment (DIMVA 2026), July 1-3, 2026, Chania, Greece. Springer Lecture Notes in Computer Science (LNCS)

详情

展开后加载摘要…

URL PDF HTML 收藏