arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 865 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 163 篇

2608.05938 2026-08-07 cs.CV cs.LG 新提交 57%

MirrorNet: Can Medical Image Anonymization Really Protect Patient Identity?

MirrorNet:医学图像匿名化真的能保护患者身份吗?

Attila Simkó

机构 * Umeå University(于默奥大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本研究提出MirrorNet模型,通过耦合循环一致变分自编码器发现去标识化医学扫描仍可识别患者,建议将其作为生物识别数据管理,相关代码与模型已公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05253 2026-08-07 cs.LG 新提交 57%

Beyond Rotations: AuroOFT for Expressive Quantized Orthogonal Fine-Tuning

超越旋转:用于表达性量化正交微调的AuroOFT

Yue Han, Dianlin Wang

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 该研究针对量化正交微调(qoft)的线性正交变换局限,提出AuroOFT方法,在保留qoft稳定分支的基础上附加零起点门控低秩非线性残差,在Qwen2.5设置上提升性能并减少可训练参数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05250 2026-08-07 cs.LG 新提交 57%

Beyond Full-Model Rollback: AuroSFT for Adapter-State Multi-Task Fine-Tuning

超越全模型回滚:用于适配器状态多任务监督微调的AuroSFT

Yue Han, Ziniu Liu

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 针对多任务SFT的全模型回滚成本高的问题,提出参数高效框架AuroSFT,将状态转为可合并的适配器状态,在保留骨干网络的比较中平均准确率达61.36%,优于msft的59.85%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04459 2026-08-06 cs.SE 新提交 57%

AdaptAgent: A Multi-agent, Domain-Guided Reasoning Framework for Code Adaptation

AdaptAgent:一种用于代码适配的多智能体、领域引导推理框架

Xiaokai Rong, Hridya Dhulipala, Aashish Yadavally, Tien N. Nguyen

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究提出AdaptAgent框架,通过分工的多智能体实现代码适配,在真实数据集上的语义正确性优于强基线,各智能体对适配效果均有重要作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02599 2026-08-04 eess.SY cs.AI cs.SY 新提交 57%

Bridging Artificial Intelligence and Power Systems Education Using a Hands-On Executable Framework

使用可执行实践框架搭建人工智能与电力系统教育的桥梁

Junjie Yin, Buxin She, Xinyu Feng, Fangxing, Li

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本文提出可执行实践框架,通过渐进式模块降低电力系统AI入门门槛,经IEEE网络研讨会验证,可满足跨学科学习者对电力专用AI实践课程的需求。

Comments 10 pages, 10 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27913 2026-07-31 cs.LG 新提交 57%

S-CEReBrO: Breaking the Memory Barrier in Continuous EEG Monitoring

S-CEReBrO:突破连续脑电图监测中的内存瓶颈

Glenn Anta Bucagu, Thorir Mar Ingolfsson, Yawei Li, Luca Benini

机构 * ETH Zurich(苏黎世联邦理工学院) Nanyang Technological University(南洋理工大学) University of Bologna(博洛尼亚大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 该研究针对连续EEG监测中Transformer架构的内存瓶颈,提出S-CEReBrO架构,通过窗口交替注意力实现内存恒定,在EEG下游任务中性能领先且效率提升。

Comments This is the pre-rebuttal version of a paper accepted at MICCAI 2026. The camera-ready version will be posted following the embargo

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25141 2026-07-29 cs.SE cs.LO cs.SY eess.SY 新提交 57%

Specification-Driven DevOps for Multi-Service Environments

多服务环境下基于规范驱动的DevOps

Oleg Grynets, Kyrylo Fursov, Vasyl Lyashkevych, Volodymyr Veres

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究探讨前沿大语言模型能否利用存储库内容为多服务应用生成配置,通过对三个异构存储库评估发现生成环境虽能运行,但有遗漏,进而区分功能正确性与部署意图保真度并得出最小显式部署规范。

Comments 25 pages, 8 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25437 2026-07-29 cs.SE quant-ph 新提交 57%

Repositories, Contributors, and Continuity: An Empirical Study of Foundational Quantum Software

存储库、贡献者与连续性:基础量子软件的实证研究

Vincent Gierisch, Nicole Hoess, Ralf Ramsauer, Wolfgang Mauerer

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究量子软件生态系统中概念和影响如何跨存储库边界持续存在,运用实证软件工程技术分析基础量子软件存储库,结合跨库活动与贡献者关系研究社区演变,发现多种发展路径并提供实证视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24512 2026-07-28 cs.AI cs.DL 新提交 57%

Making Mathematical Knowledge Explainable, Accessible and Interoperable Through Large Language Model Integration

通过大语言模型集成使数学知识可解释、可访问和可互操作

Jan Range, Björn Schembera, Dominik Göddeke

机构 * Stuttgart Center for Simulation Science (SC SimTech), University of Stuttgart(斯图加特大学斯图加特模拟科学中心 (SC SimTech)) Institute of Applied Analysis and Numerical Simulation, University of Stuttgart(斯图加特大学应用分析与数值模拟研究所)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 研究旨在解决数学模型文档不符合FAIR原则及访问难等问题,通过模型上下文协议(MCP)服务器将大语言模型与MathModDB集成,实现基于认知的LLM使用,提高可解释性、可访问性并简化互操作性,通过用例展示了集成优势。

Comments Preprint submitted to 6th Wikidata Workshop@ISWC

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21885 2026-07-27 cs.LG cs.NA eess.SP math.NA 新提交 57%

Remedying Coarsening-Based GNN Training under Heterophily via Adaptive Complementary Enhancement

通过自适应互补增强修复异质性下基于粗化的图神经网络训练

Guoming Li, Jian Yang, Xukun Wang, Zixiao Wang, Shangsong Liang, Yifan Chen

机构 * Hong Kong Baptist University(香港浸会大学) Renmin University of China(中国人民大学) Chinese Academy of Sciences(中国科学院) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Sun Yat-sen University(中山大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 研究基于粗化的GNN训练在异构图上性能下降问题,提出自适应互补增强(ACE)策略,通过重新整合粗化丢弃信息、应用正则化及不确定性加权,在异构图基准上提升性能,同构图上保持竞争力且计算开销小。

Comments Accepted at the 42nd Conference on Uncertainty in Artificial Intelligence, UAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20328 2026-07-23 cs.DL cs.AI 新提交 57%

Understanding Generative AI-mediated User Engagement with Academic Library Resources

理解生成式人工智能介导的用户对学术图书馆资源的参与度

Hae Min Kim, Stacy Stanislaw

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 该研究利用2023年8月至2025年10月网络分析,实证分析生成式人工智能介导用户对学术图书馆资源的参与度,发现流量显著增加,确定主要驱动平台,指出用户访问机构知识库情况,表明需持续分析及战略应对人工智能格局。

Comments This is the accepted manuscript. The final published version will appear in College & Research Libraries, May 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20277 2026-07-23 cs.LG 新提交 57%

Interpretable Fuzzy Rule-Based Regression Extension for Ex-Fuzzy Library

用于Ex-Fuzzy库的可解释模糊规则基回归扩展

Cayan Deniz Kucuktopana, Javier Fumanal-Idocin, Richard Pitts, Javier Andreu-Perez

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 研究针对安全关键等领域机器学习模型需可解释性的问题,为Ex-Fuzzy库提出回归扩展,采用基于模糊C均值聚类的目标感知分区初始化策略,在十个数据集上评估,高斯分区表现优,提供了透明且有竞争力的黑盒回归替代方案。

Journal ref IEEE International Conference on Fuzzy Systems (FUZZ-IEEE), IEEE World Congress on Computational Intelligence (WCCI), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17957 2026-07-21 cs.SE 新提交 57%

DepRepair: LLM-Based Source-Code Repair for Dependency Breaking Changes

DepRepair:基于大语言模型的针对依赖项破坏更改的源代码修复

Shenghao Yang, Bo Lu, Yaochen Liu, Yu Kang, Qiongfang Zhang, Chetan Bansal, Saravan Rajmohan, Minghua Ma

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究软件项目因第三方库更新致依赖项破坏更改的问题,提出DepRepair单调用大语言模型方法,通过证据过滤器、用法定位器和子类别感知指南,基于结构化上游证据修复,在DepBench基准测试中取得高可执行通过率。

Comments 10 pages, 5 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17147 2026-07-21 cs.CR cs.CL 新提交 57%

SlotGuard: Stop Oversharing Private Local Context in LLM Agent Transcri

SlotGuard:阻止大语言模型代理转录中过度共享私有本地上下文

Haocheng Xia, Yongjoo Park

机构 * Siebel School of Computing(计算机科学系) Data Science, University of Illinois Urbana-Champaign(数据科学,伊利诺伊大学厄巴纳-香槟分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 研究大语言模型代理转录本隐私泄露问题,提出SlotGuard方法,通过重写结构绑定、替换机密值、链接跨轮引用等操作隐藏敏感数据,在保持代理性能的同时大幅降低凭证泄漏率。

Comments ICML 2026 AIWILD

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13021 2026-07-15 cs.SE 新提交 57%

Software Supply Chains are Dead: Use-Case-Oriented Regeneration

软件供应链已死:面向用例的再生

Tanmay Singla, James C. Davis

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究现代软件开发中构建与复用权衡因软件供应链攻击及生成式人工智能而改变,提出面向用例的再生范式,评估智能工作流程,通过对180个存储库-依赖对测量,证明该方法可行,推动软件采购向可验证的特定于存储库的代码合成发展。

Comments [ESEM'26-ERVR] Proceedings of the 20th International Symposium on Empirical Software Engineering and Measurement (ESEM 2026 Emerging Results, Vision, and Reflection Papers)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12301 2026-07-15 cs.SE cs.MA 新提交 57%

XScientist: A Git-Like Research Protocol for Long-Running Autonomous Scientific Discovery

XScientist:用于长期自主科学发现的类似Git的研究协议

Jixiang Luo

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究针对自主研究系统的问题,提出XScientist这一类似Git的研究协议和操作系统,核心方法是将运行视为可移植工件并导出相关协议,主要贡献是使自主科学从单次演示走向可重现、可审查和可分叉的研究基础设施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10712 2026-07-14 cs.CR cs.AI cs.DL 新提交 57%

Distributed Denial of Science: How Indirect Data Poisoning of AI Systems Can Industrialize Scientific Fraud

分布式科学否认:人工智能系统的间接数据投毒如何使科学欺诈产业化

Bálint Gyevnár, Atoosa Kasirzadeh, Nihar B. Shah

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 研究探讨人工智能时代科学欺诈新形式,即间接数据投毒。对手 corrupt 开放数据集上传,使自主研究代理处理后传播欺诈。通过多话题、多系统实验发现投毒成功率高而检测率低。提出科学家角色和数据溯源审计措施,后者可有效降低攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09876 2026-07-14 cs.CV cs.AI q-bio.NC q-bio.QM 新提交 57%

Prompting-MammAlps: Fine-Grained Text-to-Video Retrieval for Camera-Trap Data

Prompting-MammAlps:用于相机陷阱数据的细粒度文本到视频检索

Valentin Gabeff, Baptiste Maquignaz, Jennifer Shan, Sepideh Mamooler, Gencer Sumbul, Blair Costelloe, Devis Tuia, Alexander Mathis

机构 * Ecole Polytechnique Fédérale de Lausanne (EPFL)(洛桑联邦理工学院) Max Planck Institute of Animal Behavior(马克斯·普朗克动物行为研究所) University of Konstanz(康斯坦茨大学)

专题命中 仓库级理解 :coding agent(abstract);分类 cs.AI

AI总结 针对相机陷阱数据自动检索视频的难题,提出Prompting-MammAlps基准及细粒度可解释TVR方法,训练视觉变压器并结合大语言模型处理查询,在基准测试中取得较好成绩,优于零样本VLM。

Comments Accepted at ECCV 2026; Project page: https://cnai.epfl.ch/prompting-mammalps

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06820 2026-07-09 cs.AI 新提交 57%

Evaluating SageMath-Augmented LLM Agents for Computational and Experimental Mathematics

评估用于计算和实验数学的SageMath增强型大语言模型智能体

Pavel Snopov, German Magai

机构 * The Sage Developers(Sage开发者团队)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 研究聚焦AI在数学领域进展,提出结合大语言模型推理与SageMath反馈的智能体设置,改进RealMath基准。实验表明该设置能提升模型性能,缩小模型差距,CAS增强型智能体在计算探索上有潜力,朝自动猜想发现迈进。

Comments 37 pages, 16 figures, accepted to 3rd AI for Math Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06258 2026-07-08 cs.CL 新提交 57%

Early Language Learning via Spreading Activation and Category Exploration in Complex Networks

通过复杂网络中的扩散激活和类别探索进行早期语言学习

Salvatore Citraro

机构 * National Research Council (CNR)(国家研究理事会)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 研究儿童词汇习得在语义和词汇类别上是否不均衡,将早期语言学习建模为基于图的搜索,由扩散激活和类别探索驱动,用多种资源评估模型在四种语言上的性能,发现扩散激活表现更好,揭示词汇发展与激活动态及约束的关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04948 2026-07-07 cs.SE 新提交 57%

Using Process Mining to Generate AI Agents from Software Engineering Process Records

利用过程挖掘从软件工程过程记录生成人工智能代理

Saimir Bala, Fabiana Fournier, Lior Limonad, Andreas Metzger

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究如何在软件工程中结合人工智能代理,面临代理粒度和关注点分离难题。通过过程挖掘,用软件库事件日志发现特定项目代理角色,生成规范与实现,并进行测试和用户研究验证效果。

Comments To be published at the 24th International Conference on Business Process Management (BPM 2026), Process Technology Forum

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03220 2026-07-07 cs.CR cs.AI 新提交 57%

CONTRA: Red-Teaming Configurations of Personalizable Agents

CONTRA:可个性化代理的红队配置

Jonathan Nöther, Adish Singla, Goran Radanovic

机构 * Max Planck Institute for Software Systems(马克斯·普朗克软件研究所)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 探讨代理配置与执行危险行为风险的关系,提出CONTRA算法,通过推理评估良性但危险的配置发现导致恶意行为的代理配置,构建数据集分析发现多数技能有恶意配置,CONTRA能成功识别部分危险配置。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01609 2026-07-03 cs.LG 新提交 57%

SINA: A Fully Automated Circuit Schematic Image to Netlist Generator Using Artificial Intelligence

SINA: 一种使用人工智能的全自动电路原理图图像到网表生成器

Saoud Aldowaish, Yashwanth Karumanchi, Kai-Chen Chiang, Mohammed Ayman Habib, Finn Murphy, Rishen Cao, Morteza Fayazi

机构 * The Department of Electrical and Computer Engineering, University of Utah(犹他大学电气与计算机工程系) The Department of Electrical, Computer & Energy Engineering, University of Colorado Boulder(科罗拉多大学博尔德分校电气、计算机与能源工程系)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 提出SINA,一种全自动开源流水线,集成深度学习、连通分量标记、OCR和视觉语言模型,实现从电路原理图图像到网表的转换,在IC和PCB级别均达到96.67%的生成准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01494 2026-07-03 cs.SE cs.ET cs.HC cs.SI 新提交 57%

Insights from GitHub Community on the Matter Standard: Developer Perspectives and Challenges

GitHub社区对Matter标准的洞察:开发者视角与挑战

Muhammad Hassan, Carl Gunter, Susan Landau, Masooda Bashir

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过分析GitHub上超过13,000个议题,识别出Matter标准在测试、互操作性、开发及平台网络方面的四大挑战,为改进测试基础设施和跨厂商指南提供机会。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26979 2026-07-03 cs.SE 新提交 57%

How Much Static Structure Do Code Agents Need? A Study of Deterministic Anchoring

代码智能体需要多少静态结构?关于确定性锚定的研究

Zhihao Lin, Mingyi Zhou, Yizhuo Yang, Li Li

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 研究轻量级静态分析(如调用图、继承层次)作为确定性锚定,通过注入结构注释提高代码智能体导航的可复现性和稳定性,发现锚定效果依赖粒度与仓库特性。

Comments Accepted to the ACM SIGSOFT International Symposium on Software Testing and Analysis (ISSTA 2026). 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00185 2026-07-02 cs.CL 新提交 57%

Structural Pattern Mining in Inka Khipus: Unsupervised Clustering, Provenance Classification, and a Computational Validation of the Santa Valley Match

印加奇普中的结构模式挖掘:无监督聚类、来源分类及圣谷匹配的计算验证

Maria Contreras

机构 * Universidad Peruana de Ciencias Aplicadas (UPC)(秘鲁应用科技大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 提出可复现的机器学习流程,对619个奇普进行无监督聚类(轮廓系数0.769)和监督来源分类(F1=0.86),并独立验证了圣谷奇普的recto/verso结构。

Comments 10 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31354 2026-07-01 cs.SE 新提交 57%

Mutating the "Immutable": A Large-Scale Study of Git Tag Alterations

改变“不可变”:Git 标签变更的大规模研究

Solal Rapaport, Laurent Pautet, Samuel Tardieu, Stefano Zacchiroli, Théo Zimmermann

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过分析3.284亿软件仓库,发现1020万次标签变更影响18.9万仓库,并与Nixpkgs交叉验证表明标签变更导致可重现构建失败,建议使用加密提交哈希固定依赖并建立审计日志。

Journal ref 2026 ACM Conference on Reproducibility and Replicability, Jul 2026, Delft, Netherlands

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22593 2026-07-01 cs.SE cs.CR 新提交 57%

On Good Authority: Release-Authority Measurement for Registry-Mediated Package Ecosystems

论良好权威:注册中心中介的包生态系统的发布权威度量

Igor Santos-Grueiro

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 提出一种前驱感知的发布权威记录,通过比较发布路径证据(发布者、仓库、工作流、来源、签名、中介)识别策略触发的发布路径不连续性,经npm等五个生态系统的审计样本验证,触发策略可有效筛选需审查的发布。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27386 2026-06-29 cs.DL cs.AI 新提交 57%

Agentic Publication Protocol: An Attempt to Modernize Scientific Publication

Agentic Publication Protocol:科学出版现代化的一次尝试

Sirui Lu, Xiao-Liang Qi

机构 * Max-Planck-Institut für Quantenoptik(马克斯·普朗克量子光学研究所) Munich Center for Quantum Science and Technology(慕尼黑量子科学与技术中心) Leinweber Institute for Theoretical Physics(莱因韦伯理论物理研究所)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 提出Agentic Publication Protocol(APP),一种将论文与代码、数据、环境信息及智能体指令打包的轻量级仓库格式,使未来研究者能直接使用操作知识。

Comments 16 pages, 5 figures and 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27041 2026-06-26 cs.LO cs.PL 新提交 57%

Formalizing a Many-Sorted Hybrid Polyadic Modal Logic in Lean

在Lean中形式化多类混合多模态逻辑

Andrei-Alexandru Oltean, Bogdan Macovei, Ioana Leuştean

专题命中 仓库级理解 :repository(abstract);分类 cs.PL

AI总结 本文在Lean中形式化了一个多类签名和多模态算子的混合模态逻辑,提供DSL用于定义语言和协议,并证明了其可靠性定理,展示了在代码验证、BAN逻辑和S5系统中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏