arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-06-23 至 2026-06-23 共收录 11 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 11 篇

2606.22263 2026-06-23 cs.CR cs.AI cs.MA cs.SE 新提交 84%

Revelio: Cost-Efficient Agentic Memory Safety Vulnerability Detection For Repository-Scale Codebases

Revelio: 面向仓库级代码库的高性价比智能体内存安全漏洞检测

Yiwei Hou, Hao Wang, Muxi Lyu, Marius Momeu, Eric Nguyen, Taige Yang, Koushik Sen, Dawn Song, David Wagner

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 仓库级理解 :repository(title,abstract);coding agent(abstract);分类 cs.SE、cs.AI

AI总结 提出Revelio框架,通过生成可执行漏洞证明并用确定性消毒器验证,结合低成本LLM和轻量静态分析,在仓库级代码库中高效发现内存安全漏洞,7个项目中19个新漏洞,成本约300美元。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21658 2026-06-23 hep-ex astro-ph.IM hep-ph 新提交 78%

Towards LLM-Powered Automation of a Dark Matter Constraint Repository

基于大语言模型的暗物质约束库自动化

Lanqing Yuan, Karthik Ramanathan

专题命中 仓库级理解 :repository(title,abstract)

AI总结 提出一个LLM流水线,从arXiv论文中提取暗物质约束曲线并生成拉取请求,在基准测试中达到90.5%的耦合类型分类准确率和0.33 dex的中位残差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14470 2026-06-23 cs.AI cs.CL cs.LG 新提交 67%

GitOfThoughts: Version-Controlled Reasoning and Agent Memory You Can Replay, Diff, and Merge

GitOfThoughts: 版本控制的推理与可回放、差异比较和合并的智能体记忆

Pavan C Shekar, Abhishek H S, Aswanth Krishnan

机构 * QpiAI

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出GitOfThoughts框架,将智能体推理树存储为git仓库,实现推理的可回放、审计和合并;实验表明,对于新问题,任何记忆格式均不能可靠提升准确率,仅当检索案例与当前问题高度相似(>0.8)时才有显著提升,且收益来自答案检索而非方法迁移。

Comments 10 pages, 1 figure, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22330 2026-06-23 cs.AI cs.SE 新提交 62%

Hypothesis-Driven Skill Optimization for LLM Agents

假设驱动的技能优化用于LLM智能体

Fangxin Shang, Yehui Yang

机构 * AI Lab, Qifu Technology(奇富科技人工智能实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI

AI总结 提出HDSO框架,通过可证伪假设与验证机制从稀疏轨迹中提取可靠技能,无需训练,在ALFWorld上提升平均成功率6.9-7.1个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23329 2026-06-23 cs.SE 新提交 57%

Generate with CodeXHug: A Dataset to Enhance Model Cards with Code Usage Patterns

Generate with CodeXHug: 一个增强模型卡片代码使用模式的数据集

Stefano Palombo, Claudio Di Sipio, Juri Di Rocco, Davide Di Ruscio

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 提出CodeXHug数据集,从HuggingFace和GitHub收集预训练模型及其代码使用模式,通过统计分析和聚类提取代表性代码模式,以支持开发者理解和使用PTMs。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21787 2026-06-23 cs.SE 新提交 57%

Towards Imputation of Pre-Trained Language Model Metadata using Semantic Fingerprinting

基于语义指纹的预训练语言模型元数据插补方法

Adekunle Ajibode, Oussama Ben Sghaier, Keheliya Gallaba, Bram Adams, Ahmed E. Hassan

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 提出语义指纹(SemFin)方法,利用Hugging Face配置文件和仓库标签自动插补缺失的PTLM元数据并重建模型谱系,在317,133个模型上相比基线提升预测准确率最高31.4%,并成功处理16.6%的孤立模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20966 2026-06-23 cs.SE 新提交 57%

Beyond the Grave: An Empirical Study of Dormancy and Revival in Scientific Open-Source Software

超越坟墓:科学开源软件休眠与复兴的实证研究

Addi Malviya Thakur, Bogdan Vasilescu, Audris Mockus

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 通过分析SciCat语料库中2984个休眠后复兴的项目,发现52.5%的休眠原因无法从仓库证据中确定,非持续性复兴是持续性复兴的2.14倍,生命周期原型比复兴机制更能预测可持续性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17431 2026-06-23 cs.CL cs.AI cs.LG 版本更新 56%

Fine-Grained Uncertainty Quantification for Long-Form Language Model Outputs: A Comparative Study

长文本语言模型输出的细粒度不确定性量化:一项比较研究

Dylan Bouchard, Mohit Singh Chauhan, Viren Bajaj, David Skarbrevik

机构 * CVS Health(CVS健康公司) Wellesley, MA(马萨诸塞州韦尔士利)

专题命中 仓库级理解 :分类 cs.CL、cs.AI、cs.LG;repository(comments)

AI总结 针对长文本生成,提出细粒度不确定性量化分类法,通过响应分解、单元级评分和响应级聚合三阶段区分方法,引入FactScore-STEM-Geo数据集,实验发现声明-响应蕴含评分优于复杂方法,声明级评分优于句子级,不确定性感知解码有效提升事实性。

Comments Accepted by TMLR; UQLM repository: https://github.com/cvs-health/uqlm

Journal ref Transactions on Machine Learning Research, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23152 2026-06-23 cs.RO 新提交 50%

ShotcreteDepth: A Bi-modal Dataset for Robust Robotic Depth Perception in Shotcrete Construction Environments

ShotcreteDepth:用于喷射混凝土施工环境中鲁棒机器人深度感知的双模态数据集

Jakub Gregorek, Lars Arnold Dethlefsen, Patrick Schmidt, Mads Essenbæk, Jonas Flink Bentzen, Lazaros Nalpantidis

机构 * Technical University of Denmark, Department of Electrical and Photonics Engineering(丹麦技术大学电气与光子工程系) Pioneer Centre for AI(人工智能先锋中心) Christiansen & Essenbæk A/S(Christiansen & Essenbæk 公司)

专题命中 仓库级理解 :repository(abstract)

AI总结 针对喷射混凝土施工环境中的感知挑战,提出双模态数据集ShotcreteDepth,包含立体RGB图像和LiDAR点云,并附带轻量级标注工具,支持立体匹配、深度补全和深度估计研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21910 2026-06-23 cs.CV 新提交 50%

Fidelity- and Perception-Aware Local Implicit Attention for Arbitrary-Scale Image Super-Resolution

保真度与感知感知的局部隐式注意力用于任意尺度图像超分辨率

Yu-Syuan Xu, Hao-Lun Sun, Hao-Wei Chen, Hsien-Kai Kuo, Chun-Yi Lee

机构 * National Taiwan University(国立台湾大学) MediaTek Inc.(联发科技股份有限公司)

专题命中 仓库级理解 :repository(abstract)

AI总结 提出FPLIA框架,通过融合保真度导向特征与扩散管道,结合FPAM和FPSM模块,在任意尺度超分辨率中实现高感知真实度与重建精度。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23259 2026-06-23 math.RA cs.SC 新提交 50%

Explicit Formula for Inverse and Determinant in Geometric Algebras over Odd-dimensional Vector Spaces

奇数维向量空间上几何代数中逆与行列式的显式公式

K. S. Abdulkhaev, D. S. Shirokov

专题命中 仓库级理解 :repository(abstract)

AI总结 针对7维向量空间的几何代数,通过推广共轭概念为基共轭运算,推导出逆和行列式的显式公式,并开发从已知偶数维情况构造奇数维公式的通用方法。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏