arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-07-28 至 2026-07-28 共收录 9 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码评测 9 篇

2607.23784 2026-07-28 cs.RO cs.AI 新提交 70%

A Few Words Go a Long Way: Language Guided Robot Policy Synthesis

寥寥数语,成效显著:语言引导的机器人策略合成

Daphne Chen, Archit Ritesh Jain, Eric Goossen, Emma Romig, Michael Murray, Nick Walker, Maya Cakmak

机构 * University of Washington(华盛顿大学) Microsoft Research(微软研究院) Massachusetts Institute of Technology(麻省理工学院)

专题命中 代码评测 :coding agent(abstract);program synthesis(abstract);分类 cs.AI

AI总结 研究针对视觉-语言-动作模型难以解释等问题,提出ARCHITECT框架,利用大语言模型编码代理合成模块化机器人程序,通过人类自然语言修正引导策略并积累技能库,在机器人基准评估中表现出色,提供了新的机器人学习方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22642 2026-07-28 cs.AI cs.CL cs.LG cs.MA cs.SE 新提交 70%

CRAFT: Learn the Schema, Execute the Plan

CRAFT:学习模式,执行计划

Aakash Kolekar, Sahika Genc, Shahriar Shariat, Bunyamin Sisman, Tibor Mezi, Barbara Poblete, Shree Vandana Kachroo, Calvin Chi, Parth Parmar, Ari Singer, Prayaas Jain, Cindy Barker, Benoit Dumoulin

机构 * Amazon Advertising Foundations(亚马逊广告基金会) Amazon Web Services Agentic AI(亚马逊网络服务代理人工智能)

专题命中 代码评测 :coding agent(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 研究企业编码代理将自然语言分析请求转换为可执行代码时的问题,提出两阶段训练后方法 CRAFT,先进行模式剥离的 PLAN 监督微调,再用执行形状的强化学习,评估显示其在多方面有提升并减少负担。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03910 2026-07-28 cs.SE cs.AI cs.CL 版本更新 67%

CodexGraph: Bridging Large Language Models and Code Repositories via Code Graph Databases

CodexGraph:通过代码图数据库连接大型语言模型和代码库

Xiangyan Liu, Bo Lan, Zhiyuan Hu, Yang Liu, Zhicheng Zhang, Fei Wang, Michael Shieh, Wenmeng Zhou

专题命中 代码评测 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 研究旨在解决大型语言模型处理整个代码库的难题,提出通过将LLM代理与代码库图数据库接口集成的CodexGraph系统,利用图数据库特性实现精确上下文检索和代码导航,经多基准评估及实际应用开发,展现其在软件工程中的竞争力与潜力。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23225 2026-07-28 cs.LG 新提交 57%

ParasGB: A Graph Benchmark Suite for Parasitic Estimation on AMS Circuits

ParasGB:用于 AMS 电路寄生估计的图形基准套件

Jiajun Zou, Jiawei Liu, Ao Liu, Junnong Tian, Yibin Zhang, Chengjie Liu, Yuxi Wang, Shan Shen, Wenhua Gu, Jun Yang, Wenjian Yu

专题命中 代码评测 :repository(abstract);分类 cs.LG

AI总结 研究针对 AMS 电路寄生估计问题,引入 ParasGB 开源基准套件,提供大规模异构 RC 网络与统一评估协议,用标准化流程对 GNN 架构基准测试,揭示相关挑战,为电路图学习和寄生感知模型开发提供可重复研究平台。

Comments Published at ICCAD2026. Full appendix version

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22654 2026-07-28 cs.AI 新提交 57%

MINT-V2X: A Mobility-Integrated Network Trajectory Dataset for Predictive Resource Management

MINT-V2X:用于预测资源管理的移动集成网络轨迹数据集

Abdullah Anjum, Abdolazim Rezaei, Mehdi Sookhak

专题命中 代码评测 :repository(abstract);分类 cs.AI

AI总结 本文介绍用于预测资源管理的移动集成网络轨迹数据集MINT-V2X,它通过耦合SUMO与OMNeT++/Simu5G生成,经多项测试验证,包含大量同步数据点,通过案例研究证明其在RSU负载预测上比仅用网络历史基线性能更好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22588 2026-07-28 cs.AI cs.DC 新提交 57%

ParBench: A Benchmark for Reliable Evaluation of LLM Parallel Code Translation

ParBench:用于可靠评估大语言模型并行代码翻译的基准测试

Samyak Jhaveri, Erel Kaplan, Tom Yotam, Le Chen, Tomer Bitan, Niranjan Hasabnis, Gal Oren

专题命中 代码评测 :coding agent(abstract);分类 cs.AI

AI总结 研究针对大语言模型并行代码翻译缺乏可靠评估方法的问题,提出ParBench基准框架,通过声明性规范评估,涵盖多开源套件与跨API翻译方向,经源增强测试,揭示了当前并行代码翻译存在的如方向不对称等障碍。

Comments 57 pages, 22 figures, 11 tables; includes appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22573 2026-07-28 cs.AI cond-mat.mtrl-sci physics.comp-ph 新提交 57%

PhononBench-MP40: a spectrum-resolved benchmark dataset for phonon stability

PhononBench-MP40:用于声子稳定性的光谱分辨基准数据集

Wen-Kao Li, Ze-Feng Gao, Zhong-Yi Lu

机构 * School of Physics and Key Laboratory of Quantum State Construction and Manipulation (Ministry of Education), Renmin University of China(中国人民大学物理学院及量子态构建与调控教育部重点实验室)

专题命中 代码评测 :repository(abstract);分类 cs.AI

AI总结 研究针对计算材料筛选中虚声子模式瓶颈,提出PhononBench-MP40数据集,源于47969个MP40任务,含4类记录。通过科学数据银行公开,配套GitHub仓库提供代码等,为相关研究提供可审计参考。

Comments 18 pages, 3 figures, includes Supplementary Information

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31767 2026-07-28 cs.SE 版本更新 57%

JETO-Bench: A Reproducible Benchmark for Execution Time Improvement Patches in Java

JETO-Bench: Java执行时间改进补丁的可复现基准测试

Khashayar Etemadi, Zhendong Su

专题命中 代码评测 :coding agent(abstract);分类 cs.SE

AI总结 提出JETO-Mine工具,通过静态分析、动态分析和评估框架自动构建可复现的Java执行时间改进补丁基准,并构建包含660个补丁的JETO-Bench,验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05819 2026-07-28 cs.CV cs.AI 57%

Deformable Image Registration for Self-supervised Cardiac Phase Detection in Multi-View Multi-Disease Cardiac Magnetic Resonance Images

可变形图像配准用于多视角多疾病心脏磁共振图像的自监督心脏相位检测

Sven Koehler, Sarah Kaye Mueller, Jonathan Kiekenap, Gerald Greil, Tarique Hussain, Samir Sarikouch, Florian André, Norbert Frey, Sandy Engelhardt

机构 * Department of Internal Medicine III, Heidelberg University Hospital(海德堡大学第三内科部门医院) Medical Faculty of Heidelberg University(海德堡大学医学院) DZHK (German Centre for Cardiovascular Research)(德国心血管研究中心) Division of Pediatric Cardiology, Department of Pediatrics, UT Southwestern /Children’s Health(儿童心脏病科,德克萨斯西南医学中心/儿童健康) Department of Cardiothoracic, Transplantation and Vascular Surgery, Hannover Medical School(汉诺威医学院心胸外科、移植外科和血管外科部门)

专题命中 代码评测 :repository(abstract);分类 cs.AI

AI总结 本文提出一种自监督深度学习方法,通过多视角多疾病心脏磁共振图像检测五个关键帧,提高了心脏相位检测的准确率,适用于SAX和4CH cine CMR。

Comments Main 30 pages, 6 figures

Journal ref Medical Image Analysis, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏