arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-07-27 至 2026-07-27 共收录 6 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 2 篇

2508.11136 2026-07-27 cs.LO 版本更新 78%

Automating the Derivation of Unification Algorithms: A Case Study in Deductive Program Synthesis

自动推导合一算法:演绎程序合成的一个案例研究

Richard Waldinger

专题命中 代码生成 :program synthesis(title,abstract)

AI总结 该研究聚焦于合一算法的自动推导,以演绎程序合成方式,将编程视为定理证明任务。通过推广和自动化手动证明,新程序能依给定环境替换合一符号表达式,确定输出替换,还能处理不可合一情况,且怀疑带环境的算法更易自动合成。

Comments 92 pages

Journal ref Journal of Symbolic Computation, January-February 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08379 2026-07-27 cs.AI 版本更新 57%

DeepFeature: LLM-Empowered Context-aware Feature Generation for Wearable Biosignals

DeepFeature: 基于迭代上下文感知的可穿戴生物信号特征生成

Kaiwei Liu, Yuting He, Bufang Yang, Mu Yuan, Chun Man Victor Wong, Ho Pong Andrew Sze, Zhenyu Yan, Hongkai Chen

机构 * The Chinese University of Hong Kong(香港中文大学) The Education University of Hong Kong(香港教育大学) Hong Kong Applied Science and Technology Research Institute(香港应用科学和技术研究院)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 DeepFeature是一种基于大语言模型的上下文感知特征生成框架,通过多源特征生成机制和迭代特征细化过程,提升可穿戴生物信号的特征提取效果。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 1 篇

2607.16617 2026-07-27 cs.SE cs.AI 版本更新 62%

DataFlow-Harness: A Grounded Code-Agent Platform for Constructing Editable LLM Data Pipelines

DataFlow-Harness:用于构建可编辑大语言模型数据管道的基础代码代理平台

Runming He, Zhen Hao Wong, Hao Liang, Zimo Meng, Chengyu Shen, Xiaochen Ma, Wentao Zhang

机构 * Peking University(北京大学) Institute for Advanced Algorithms Research(先进算法研究所) Zhongguancun Academy(中关村学院)

专题命中 软件智能体 :coding agent(abstract);分类 cs.SE、cs.AI

AI总结 研究针对大语言模型数据处理工作流中编码代理脚本无法自动转化为可编辑工件的问题,提出DataFlow-Harness平台,通过类型化增量突变引导构建DAG,结合多种技术,在数据工程基准测试中取得高通过率,降低成本和延迟。

Comments 13 pages, 2 figures, and 5 tables. Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 代码评测 2 篇

2607.20491 2026-07-27 cs.AI cs.CL cs.LG 版本更新 67%

DFAH-Bench: Benchmarking Observable Agent Instability in Financial Decision-Making

DFAH-Bench:金融决策中可观测智能体不稳定性的基准测试

Raffi Khatchadourian

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究金融决策中智能体行为稳定性,引入DFAH-Bench基准,通过多渠道衡量。发现仅结果一致性不能完全反映稳定性,前沿模型存在决策与工具路径一致性差距,识别出三种行为模式,并开源相关代码和数据。

Comments 15 pages, 3 figures. Code, sanitized replay logs, one-command reproduction (make reproduce-paper), and an interactive results explorer: https://github.com/ibm-client-engineering/output-drift-financial-llms

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15781 2026-07-27 cs.AI cs.ET cs.MA 版本更新 57%

AgentFAIR: A Multi-Agent Collaborative Framework for FAIRness Evaluation of Geospatial Datasets

AgentFAIR:用于地理空间数据集公平性评估的多智能体协作框架

Ming Chen, Pranav Pai

机构 * The University of Melbourne(墨尔本大学)

专题命中 代码评测 :repository(abstract);分类 cs.AI

AI总结 研究地理空间数据集公平性评估难题,提出AgentFAIR多智能体框架,结合结构化元数据提取与特定子原则语言模型评估器,给出各项评估结果,支持可审计性与可行性,不过受限于多种因素对准确性和泛化性声明有约束。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 仓库级理解 1 篇

2606.21187 2026-07-27 cs.SE 版本更新 57%

Change Impact Recommendation for JavaScript: Lessons from History and Runtime Analysis

JavaScript变更影响推荐:来自历史和运行时分析的教训

Sadjad Tavakoli, Saba Alimadadi

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 针对JavaScript动态特性导致的依赖推断难题,通过结合历史共变模式挖掘和动态依赖分析,提出混合方法Caprese,实验表明两种信号互补,混合推荐效果更优。

详情

展开后加载摘要…

URL PDF HTML 收藏