arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-07-14 至 2026-07-14 共收录 6 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码评测 6 篇

2606.11864 2026-07-14 cs.IR 版本更新 67%

CORE-Bench: A Comprehensive Benchmark for Code Retrieval in the Era of Agentic Coding

CORE-Bench:智能体编程时代代码检索的综合基准

Fuwei Zhang, Yanzhao Zhang, Mingxin Li, Dingkun Long, Lexiang Hu, Pengjun Xie, Zhao Zhang, Fuzhen Zhuang

专题命中 代码评测 :repository(abstract);coding agent(abstract)

AI总结 针对智能体编程中需求驱动的仓库级代码检索问题,构建了包含18万查询和10.6万上下文相关性标签的三级基准CORE-Bench,实验表明现有嵌入模型性能显著下降,微调可提升效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10212 2026-07-14 cs.AI cs.CL 新提交 62%

KGCQual: An Interpretable Framework for Evaluating the Knowledge Graph Construction Quality from Text

KGCQual:一个用于评估从文本构建知识图谱质量的可解释框架

Nipun Misra, Vikranth Udandarao, Aanchal Gupta, Yogender Kumar, Manuj Mukherjee, Raghava Mutharaju

机构 * VIT Vellore(维洛尔理工学院) IIIT-Delhi(德里信息技术学院) Indian Institute of Technology Palakkad(印度理工学院帕拉卡德分校)

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

AI总结 该研究针对自动构建知识图谱质量评估问题,提出KGCQual框架,通过实体级和关系级评估,衡量提取图谱与理想图谱的接近度,能识别现有指标遗漏问题,为比较构建方法提供可扩展、可解释框架,还通过实验验证了指标有效性。

Comments This paper is under review at a conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09791 2026-07-14 cs.LG cs.CL 新提交 62%

Gauge dependence and structured-output corruption in sign-branched repetition penalties: measurements across models, inference stacks, and alternative repetition controls

符号分支重复惩罚中的规范依赖性和结构化输出损坏:跨模型、推理堆栈和替代重复控制的测量

Peter Hollows

专题命中 代码评测 :code model(abstract);分类 cs.CL、cs.LG

AI总结 研究符号分支重复惩罚中规范依赖性和结构化输出损坏问题,发现其惩罚定义不明确且损坏输出,将惩罚应用于归一化对数概率可消除这些问题,给出了相关机制、测量及归一化变体。

Comments 8 pages, 2 figures, 4 tables. Code, data, per-stack survey and git genealogy: https://github.com/captainpete/repetition-penalty-gauge

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07204 2026-07-14 math.OC cs.LG 版本更新 57%

Restricted Dynamic Geometric Complexity: Path-Space Reduction and Möbius--Jacobi Response

受限动态几何复杂度:结构化预处理的证书

Zavier Li

机构 * Xidian University(西安电子科技大学)

专题命中 代码评测 :repository(abstract);分类 cs.LG

AI总结 研究优化几何动力学中受限动态几何复杂度,通过发展相关理论,如单调性和子流形距离原理等,将结构化预处理器问题转化为几何问题,还给出低秩谱模型等诊断接口及相关工作流程。

Comments 32 pages, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09882 2026-07-14 quant-ph cs.DC cs.PF 新提交 50%

Benchmarking Zero-Setup Quantum Circuit Simulators

零设置量子电路模拟器的基准测试

Arul Rhik Mazumder, Mohammed Zuhair Mullath, Hayk Tepanyan

专题命中 代码评测 :repository(abstract)

AI总结 该研究对GPU加速的MPS和PPS量子模拟方法进行基准测试,比较多个工具,发现MPS中GPU运行时随键维度次二次缩放,PPS中GPU在特定基准测试下加速显著且能达高精度,还提供模拟器特征描述及代码配置仓库。

Comments 12 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08164 2026-07-14 cs.CV 版本更新 50%

Continual Test-Time Adaptation in Computer Vision: Methods, Benchmarks, and Future Directions

计算机视觉中的持续测试时间适应:方法、基准和未来方向

Sarthak Kumar Maharana, Shambhavi Mishra, Yunbei Zhang, Shuaicheng Niu, Taki Hasan Rafi, Jihun Hamm, Marco Pedersoli, Jose Dolz, Yunhui Guo

机构 * The University of Texas at Dallas(德克萨斯大学达拉斯分校) LIVIA ETS Montreal, ILLS International Laboratory on Learning Systems (ILLS)(蒙特利尔LIVIA ETS,学习系统国际实验室(ILLS)) Tulane University(路易斯安那州立大学) Nanyang Technological University(南洋理工大学) Hanyang University(翰阳大学)

专题命中 代码评测 :repository(abstract)

AI总结 本文针对计算机视觉中训练与测试数据分布不同的问题,定义CTTA问题,分析持续域转移模式,提出分层分类法将现有方法分为三类,回顾代表性方法并展示实验结果,讨论局限性与新兴方向,为持续测试时间适应研究提供路线图。

Comments TMLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏