arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 865 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 163 篇

2606.27055 2026-06-26 astro-ph.EP astro-ph.IM astro-ph.SR cs.CG cs.SE 新提交 57%

Solarsystem: A Validated Lightweight Python Package for Planetary Positions and Solar-Lunar Event Calculations

Solarsystem: 一个经过验证的轻量级Python包,用于行星位置和太阳-月球事件计算

Ioannis Nasios

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本文介绍solarsystem,一个轻量级、无依赖的Python包,使用解析模型计算行星位置和太阳-月球事件,经JPL DE440星历验证,平均经度偏差0.44角分,纬度偏差0.16角分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23984 2026-06-24 cs.SE 新提交 57%

Domain-Driven Design in Practice: A Mining Study of Maintenance and Evolution in Open-Source Repositories

领域驱动设计实践:开源仓库中维护与演化的挖掘研究

Weixing Zhang, Bowen Jiang, Yuhong Fu, Haowei Cheng, Mario Herb, Anne Koziolek

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过挖掘GitHub仓库,研究领域驱动设计战术构建块的分布、演化及其对软件维护质量的影响,量化边界上下文违规的规模与维护关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23329 2026-06-23 cs.SE 新提交 57%

Generate with CodeXHug: A Dataset to Enhance Model Cards with Code Usage Patterns

Generate with CodeXHug: 一个增强模型卡片代码使用模式的数据集

Stefano Palombo, Claudio Di Sipio, Juri Di Rocco, Davide Di Ruscio

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 提出CodeXHug数据集,从HuggingFace和GitHub收集预训练模型及其代码使用模式,通过统计分析和聚类提取代表性代码模式,以支持开发者理解和使用PTMs。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21787 2026-06-23 cs.SE 新提交 57%

Towards Imputation of Pre-Trained Language Model Metadata using Semantic Fingerprinting

基于语义指纹的预训练语言模型元数据插补方法

Adekunle Ajibode, Oussama Ben Sghaier, Keheliya Gallaba, Bram Adams, Ahmed E. Hassan

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 提出语义指纹(SemFin)方法,利用Hugging Face配置文件和仓库标签自动插补缺失的PTLM元数据并重建模型谱系,在317,133个模型上相比基线提升预测准确率最高31.4%,并成功处理16.6%的孤立模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20966 2026-06-23 cs.SE 新提交 57%

Beyond the Grave: An Empirical Study of Dormancy and Revival in Scientific Open-Source Software

超越坟墓:科学开源软件休眠与复兴的实证研究

Addi Malviya Thakur, Bogdan Vasilescu, Audris Mockus

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过分析SciCat语料库中2984个休眠后复兴的项目,发现52.5%的休眠原因无法从仓库证据中确定,非持续性复兴是持续性复兴的2.14倍,生命周期原型比复兴机制更能预测可持续性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17858 2026-06-17 cs.LG 新提交 57%

Meta-classification of one-class classification models using ranking correlation and nearest neighbor

使用排序相关性和最近邻的一类分类模型的元分类

Toshitaka Hayashi, Hamido Fujita, Dalibor Cimr, Richard Cimler, Jitka Kühnová

机构 * Faculty of Science, University of Hradec Kralove(赫拉德茨-克拉洛韦大学理学院) Malaysia-Japan International Institute of Technology (MJIIT), Universiti Teknologi Malaysia(马来西亚-日本国际技术学院,马来西亚理工大学) Regional Research Center, Iwate Prefectural University(岩手县立大学区域研究中心)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 提出用排序相关性和最近邻对一类分类模型进行元分类,实验表明能高精度区分数据集、算法和超参数,本质是数据集分类。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17628 2026-06-17 cs.CL 新提交 57%

OPD-Evolver: Cultivating Holistic Agent Evolver via On-Policy Distillation

OPD-Evolver:通过在线策略蒸馏培养整体智能体进化器

Guibin Zhang, Xun Xu, Yanwei Yue, Zikun Su, Wangchunshu Zhou, Xiaobin Hu, Shuicheng Yan

机构 * LV-NUS Lab(林文实验室) FDU(福建大学) PKU(北京大学) Bytedance Inc.(字节跳动公司)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 提出OPD-Evolver框架,通过快慢双循环和在线策略自蒸馏,使智能体学会选择、使用、编写和维护经验,在多个基准上超越现有方法,并让小模型挑战大模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18032 2026-06-17 math.NA cs.LG cs.NA physics.comp-ph 新提交 57%

INI-VPINN: A Variational Physics-Informed Neural Network with Implicit Neumann and Interface Handling for Multi-Material Domains with Geometric Singularities

INI-VPINN:一种隐式处理纽曼边界和界面的变分物理信息神经网络,适用于具有几何奇异性的多材料域

Shayan Dodge, Alessandro Formisano, Sami Barmada

机构 * DESTeC University of Pisa(DESTeC 帕尔米斯大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 提出一种新的弱形式物理信息神经网络INI-VPINN,通过隐式处理纽曼边界和界面条件,无需额外损失项或多子域网络,在多材料问题中实现更高精度和更快收敛。

Comments Preprint version. Under peer review. Code available at: https://github.com/ShayanDodge/INI-VPINN

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15783 2026-06-16 cs.CL 新提交 57%

ttda704 at SemEval-2026 Task 4: Modeling Narrative Structures via Pseudonymization and Multi-View Sentence Alignment

ttda704 在 SemEval-2026 任务 4:通过假名化和多视角句子对齐建模叙事结构

Tai Tran Tan, An Dinh Thien

机构 * University of Information Technology, Ho Chi Minh City, Vietnam(胡志明市信息技术大学) Vietnam National University, Ho Chi Minh City, Vietnam(越南国立大学胡志明市分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 提出基于对比学习和微调句子变换器的叙事相似度方法,包括单视角(智能层冻结)和多视角(主题/情节/结局投影头+自监督对齐)两条流水线,在合成数据上训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13295 2026-06-16 stat.ML cs.LG stat.ME 新提交 57%

Simultaneous Latent Budget Trees for Stratified Classification

用于分层分类的同时潜在预算树

Simultaneous Latent Budget Trees for Stratified Classification Cristian Buoncompagni, Stefano Pellegrino, Giulia Vannucci, Raffaele Dubbioso, Roberta Siciliano

机构 * Department of Physics, University of Naples Federico II(物理系,那不勒斯费德里科二世大学) Department of Electrical Engineering and Information Technologies, University of Naples Federico II(电气工程与信息科技系,那不勒斯费德里科二世大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 提出同时潜在预算树框架,通过模型驱动的分裂规则处理分层因素,实现可解释分类,并应用于肌萎缩侧索硬化症性别差异分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14616 2026-06-15 cs.SE 新提交 57%

GitHub Template Repositories: Served Domains, Maintenance, and Practitioner Guidelines

GitHub 模板仓库:服务领域、维护与从业者指南

Leuson Da Silva, Altaf Allah Abbassi, Imen Trabelsi, Paulo Borba, Foutse Khomh

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过对五种主流编程语言的 GitHub 模板仓库进行大规模实证研究,分析了模板的服务领域、维护特征及质量问题,并提出了设计和管理模板的实用指南。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13392 2026-06-15 cs.AI 新提交 57%

MiniMax Sparse Attention

MiniMax 稀疏注意力

Xunhao Lai, Weiqi Xu, Yufeng Yang, Qiaorui Chen, Yang Xu, Lunbin Zeng, Xiaolong Li, Haohai Sun, Haichao Zhu, Vito Zhang, Jinkai Hu, Jiayao Li, Rui Gao, Zekun Li, Songquan Zhu, Jingkai Zhou, Pengyu Zhao

机构 * MiniMax Peking University(北京大学) NVIDIA(英伟达) Zhejiang University(浙江大学) Huazhong University of Science and Technology(华中科技大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 提出 MiniMax 稀疏注意力(MSA),一种基于分组查询注意力的块级稀疏注意力机制,通过轻量索引分支选择 Top-k 键值块,实现高效长上下文处理,在 109B 模型上以 1M 上下文减少 28.4 倍注意力计算,并带来 14.2 倍预填充和 7.6 倍解码加速。

Comments 30 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12040 2026-06-12 cs.AI cs.GR 新提交 57%

A Lightweight Multi-Agent Framework for Automated Concrete Barrier Design

一种用于自动混凝土护栏设计的轻量级多智能体框架

Wanting Wang, Xiye Ma, Yuyang He, Minghui Cheng, Ran Cao

机构 * College of Civil Engineering, Hunan University(湖南大学土木工程学院) Department of Civil and Architectural Engineering, University of Miami(迈阿密大学土木与建筑系) School of Architecture, University of Miami(迈阿密大学建筑学院)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 提出基于AutoGen的“生成-评估-优化”闭环多智能体框架,实现混凝土护栏自动设计,准确率超98%,且8B参数轻量模型可优于631B旗舰模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11462 2026-06-11 cs.SE 新提交 57%

Defeater Cards: Characterizing and Managing Safety Assurance Case Defeaters

Defeater Cards: 表征和管理安全保证案例的击败者

Usman Gohar, Michael C. Hunter, Salil Purandare, Jordan J. Rios, Myra B. Cohen, Robyn R. Lutz

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 提出Defeater Cards结构化文档,基于5W1H框架系统表征、推理和管理安全案例中的击败者,通过跨领域案例研究验证其暴露隐藏假设、发现推理缺口和支持持续演化的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08970 2026-06-09 cs.AI 新提交 57%

An Effective Router for Vision-Language Model Selection

一种有效的视觉-语言模型选择路由器

Can Wang, Shengwei Wang, Bolin Zhang, Zhiying Tu, Dianhui Chu

机构 * Harbin Institute of Technology(哈尔滨工业大学) Shandong Key Laboratory of Digital Service Computing Technology and Systems(山东省数字服务计算技术与系统重点实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 针对视觉-语言模型(VLM)选择中数据缺乏、特征表示无效和模型空间僵化的问题,提出ARMS路由器,通过增强输入信号和扩展训练策略,在分布内和分布外测试集上表现优异,仅800M参数即可超越GPT-4o。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08944 2026-06-09 cs.AR cs.PL 新提交 57%

LongRTL: Graph-Similarity-Guided LLM-driven Long Context RTL Optimization

LongRTL:基于图相似性的LLM驱动的长上下文RTL优化

Yuyang Ye, Che-Kuan Shen, Xiangfei Hu, Yuchen Liu, Shuo Yin, Xufeng Yao, Bei Yu, Tsung-Yi Ho

专题命中 仓库级理解 :code generation(abstract);分类 cs.PL

AI总结 提出一种基于图相似性的LLM驱动RTL优化框架,通过分区、优化和重构三个智能体解决长上下文RTL代码的优化问题。

Comments 7 pages, 6 figures, 5 tables, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07342 2026-06-08 cs.CL cs.NE 新提交 57%

LLM-Guided Evolution for Medical Decision Pipelines

LLM引导的医疗决策流程进化

Ivan Sviridov, Artem Oskin, Ivan Panin, Iaroslav Bespalov, Dmitry Dylov, Ivan Oseledets, Aleksandr Nesterov

机构 * Sber AI Lab(Sber AI实验室) AIRI

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 提出LLM引导的MAP-Elites进化方法,无需微调即可优化医疗决策流程,在分诊、咨询和图像分类任务中超越手工设计基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06786 2026-06-08 cs.LG cs.NI 新提交 57%

Federated Foundation Models over Vehicular Networks

车辆网络中的联邦基础模型

Kasra Borazjani, Fardis Nadimi, Payam Abdisarabshali, Owen Palinski, Allan Salihovic, Dinh Nguyen, Minghui Liwang, Seyyedali Hosseinalipour

机构 * University of Waterloo(多伦多大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.LG

AI总结 本文提出将多模态多任务联邦基础模型(M3T FedFMs)集成到车辆网络中的愿景,结合基础模型的表达力与联邦学习的隐私保护分布式学习能力,并通过Waymo数据集案例验证其潜力。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23806 2026-07-28 cs.CL cs.AI cs.IR cs.LG cs.PF 新提交 56%

A Frozen 12B Beats Frontier Models on Verified Work: 100% Accuracy, 0 Tokens, Bit-Exact, Forever

一个冻结的12B模型在经过验证的任务上超越前沿模型:100%准确率、零token、位精确、永远如此

Sietse Schelpe

专题命中 仓库级理解 :分类 cs.CL、cs.AI、cs.LG;repository(comments)

AI总结 研究提出一种让模型冻结,通过增长持久内存来解决问题的方法。在多个问题族实例上,四种架构得分优异,执行与参数扩展解耦。该方法在开放式推理中也有效,内存选择快,存储规模大,在已验证任务上超越前沿模型。

Comments Industry experience report. 14 pages, 8 figures. Public testbench: https://corbenic-galahad-bench.hf.space; companion repository with SHA-256 provenance manifest: https://github.com/corbenicai/galahad-bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14397 2026-07-17 cs.CE 新提交 56%

Model-Informed Joint Material-Structural Optimization of Hard-Magnetic Soft Materials

硬磁软材料的模型驱动联合材料-结构优化

Ian Galloway, Prashant K. Jha

专题命中 仓库级理解 :repository(abstract,comments)

AI总结 针对硬磁软材料,开发模型驱动框架,将多种关系纳入统一剪切模量框架获多个本构模型,经实验选代表性关系,再用所选模型开发联合材料-结构优化框架,可处理不同设计情况,产生规定变形响应设计并开源实现。

Comments 53 pages, 20 figures, 8 tables; Repository: https://github.com/CEADpx/top_optim

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11348 2026-08-13 cs.CR 新提交 50%

An Empirical Study of Output-to-Input Loops for Black-Box Backdoor Detection in Fine-Tuned Open-Weight LLMs

针对微调开源权重大语言模型的黑盒后门检测的输出-输入循环的实证研究

Md. Nahid Hasan, Mohammad Arif Hossain

专题命中 仓库级理解 :repository(abstract)

AI总结 本研究提出self-feeding黑盒测试方法,通过将LLM自身输出反馈为输入检测后门,在6个开源权重LLM上实现高模型级检测精度,仅需文本级查询访问即可作为模型安全的低成本初查手段。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11262 2026-08-13 physics.data-an hep-ex hep-lat hep-ph 新提交 50%

Analytically Consistent Reconstruction of Finite Data Using Padé Sequences

利用帕德序列对有限数据进行解析一致的重构

Emerson Díaz, Balma Duch, Pere Masjuan

专题命中 仓库级理解 :repository(abstract)

AI总结 该研究提出一种基于帕德序列的算法,将弗罗萨尔特双极点作为诊断对象,可从含不确定性的有限数据中重构解析结构,区分真实特征与虚假结构,已通过多种函数和数据集验证,代码存于GitLab。

Comments 25 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10914 2026-08-12 quant-ph 新提交 50%

A Quantum Dynamics Tutorial: Visualising Dynamical Decoupling Sequences on the Bloch Sphere

量子动力学教程:在布洛赫球上可视化动力学去耦序列

Charlie J. Patrickson, Isaac Bailey, Antonio Orazzo, Luca Dellantonio, Isaac J. Luxmoore

专题命中 仓库级理解 :repository(abstract)

AI总结 本教程从实验视角出发,借助布洛赫球可视化动力学去耦序列的量子动力学,阐明相干时间定义,提供开放脚本以助力新研究者掌握该量子控制工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06682 2026-08-10 math.NT 新提交 50%

Squarefree numbers in short intervals: explicit and formalized

短区间中的无平方因子数:显式结果与形式化

Mayank Pandey

专题命中 仓库级理解 :repository(abstract)

AI总结 作者将短区间无平方因子数的相关结果显式化并在Lean 4中形式化,给出了特定参数下的误差界,阐述了指数显式化及形式化的相关工作。

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05316 2026-08-07 cs.CR 新提交 50%

The Trust-Free Aggregation Layer of the Unicity Infrastructure

Unicity基础设施的无信任聚合层

Risto Laanoja, Mike Gault, Dirk Draheim, Ahto Buldas

专题命中 仓库级理解 :repository(abstract)

AI总结 该研究提出Unicity区块链基础设施的无信任聚合层,采用RSMT、Plonky3 STARK工具包等技术,实现无可信设置,达每秒万次插入及毫秒级验证的双重支付防护方案。

Comments 42 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01906 2026-08-04 cs.CV 新提交 50%

Assessing the Benefits of Combining Advanced Deep Learning Techniques for Post-Disaster Building Damage Assessment from UAV Imagery

结合先进深度学习技术的优势,从无人机影像中评估灾后建筑物损毁情况

Huy Quang Ung, Guillaume Habault, Roberto Legaspi, Hao Niu, Lian Cao, Masato Taya

机构 * KDDI Research, Inc.(KDDI研究所)

专题命中 仓库级理解 :repository(abstract)

AI总结 本文提出将CV模型与LVLM结合的混合框架,在RescueNet、FloodNet基准上评估,可准确统计灾后建筑物损毁情况,性能优于单独基准模型且仅需少量标注数据,相关资源公开。

Comments Accepted at ECMLPKDD 2026, 31 pages (including appendix), 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00132 2026-08-04 cs.CR 新提交 50%

Enforcing Access Control in Distributed Version Control Systems

在分布式版本控制系统中实施访问控制

Xin Xu, Quanwei Cai, Jingqiang Lin, Shiran Pan, Liangqin Ren

专题命中 仓库级理解 :repository(abstract)

AI总结 针对分布式版本控制系统(DVCS)访问控制方案不适配的问题,提出分布式访问控制方案Disac,采用ABE和ABS实现权限控制,可轻松集成到Git客户端。

Comments 6 pages, 2 figures. Author-accepted manuscript

Journal ref 2019 IEEE International Conference on Multimedia and Expo (ICME), pp. 772-777, 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01491 2026-08-04 physics.ed-ph physics.class-ph 新提交 50%

The First Variational Formula and the Ostrogradsky Formalism

第一变分公式与奥斯特罗格拉德斯基形式主义

Drew Watson, Matthew Pontius, Charles Torre

专题命中 仓库级理解 :repository(abstract)

AI总结 本文推导适合本科生的经典力学中拉格朗日量的奥斯特罗格拉德斯基形式主义,提供实例、习题与应用,配套程序代码可在补充材料及GitHub获取,用于定义力学系统哈密顿形式主义。

Comments Accepted for publication in the American Journal of Physics. 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28654 2026-08-03 cs.CG 新提交 50%

Arranging circles of radii 1,2,...,n around a central circle: a Supnick TSP and certified finite optima

将半径为1,2,…,n的圆围绕一个中心圆排列:一个Supnick旅行商问题与已验证的有限最优解

Maurizio Falconi

专题命中 仓库级理解 :repository(abstract)

AI总结 该研究针对半径1到n的圆围绕中心圆排列的优化问题,证明其最优循环顺序为Supnick顺序,验证3≤n≤14的全局最优解,提出R*(n)的渐近形式猜想。

Comments 10 pages, 2 figures; source code and certificate artifacts available at https://github.com/falker47/ringmin

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27519 2026-07-31 physics.ed-ph 新提交 50%

Intro2QC: An Approachable Introduction to Quantum Computing for STEM Education in High Schools

Intro2QC:面向高中STEM教育的易理解量子计算入门

Jaimie A. Greasley, Thomas E. Baker

专题命中 仓库级理解 :repository(abstract)

AI总结 本文介绍了面向高中生的 Intro2QC 量子计算推广 workshop 材料,含在线教程、教案和幻灯片,已向约160名学生开展,旨在以易理解的方式推动高中量子计算教育。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏