arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 266 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 266 篇

2607.25865 2026-07-29 quant-ph cs.AI cs.MA 新提交 57%

OmniQEC: discovering practical quantum error-correcting codes by an AI scientist

OmniQEC:通过人工智能科学家发现实用的量子纠错码

Ge Yan, Shanchuan Li, Pengyue Ma, Qixin Zhang, Pingchuan Ma, Jianping Wang, Min-Hsiu Hsieh, Yuxuan Du

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 研究旨在发现实用量子纠错码,核心方法是用OmniQEC,它结合自我进化推理与慢快协同工作流程,通过代码级代理探索候选方案并经电路级评估反馈证据。贡献是发现的代码性能优且硬件友好,为大语言模型辅助量子纠错发现奠基。

Comments Comments are welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24259 2026-07-28 cs.AI 新提交 57%

Generative Artificial Intelligence (GenAI) to convert images of queuing networks into verifiable simulation models: an open-weight LLM workflow approach

生成式人工智能(GenAI)将排队网络图像转换为可验证的仿真模型:一种开放权重的大语言模型工作流方法

Thomas Monks, Alison Harper, Amy Heather, Navonil Mustafee

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 研究提出Sketch2DES工作流,利用开放权重LLMs将排队网络图像转换为可验证仿真模型,经多阶段处理,在多图表评估中各阶段可靠性高,相比直接代码生成提升多项性能,证明结构化工作流模型生成对LLM辅助仿真建模的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22759 2026-07-28 cs.AR cs.LG 新提交 57%

Benchmarking LLMs for Verilog Design Flows

对用于Verilog设计流程的大语言模型进行基准测试

Angshuman Chakravertty, Rahul Koshti, Buddhi Prakash Sharma, Vinay Chamola

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 研究针对大语言模型生成Verilog RTL代码能力的基准测试问题,提出含特定流程的可重复平台,经测试提升了开源模型的语法有效性和模拟通过率,且平台与数据集开源,利于生成式人工智能在硬件设计工作流的评估。

Comments 7 pages, 3 figures, 3 tables. Manuscript prepared for submission to IEEE Design & Test

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22652 2026-07-28 cs.AI 新提交 57%

KG2Code: Bridging Knowledge Graphs and Large Language Models via Executable Code for Question Answering

KG2Code:通过可执行代码连接知识图谱与大语言模型以进行问答

Yike Wu, Nan Hu, Guilin Qi, Guohui Xiao, Chen Jiang, Xinchun Zou, Yuchen Lu, Songlin Zhai, Yongrui Chen, Yuyang Zhang, Xiaoguang Li, Lifeng Shang, Jiaoyan Chen, Jeff Z. Pan

机构 * Southeast University(东南大学) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education(教育部新一代人工智能技术及其交叉应用重点实验室(东南大学)) Huawei Technologies(华为技术有限公司) University of Manchester(曼彻斯特大学) University of Edinburgh(爱丁堡大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 研究针对知识图谱问答中现有方法的局限,提出KG2Code方法,将知识图谱转换为代码表示,在此基础上构建KG2Code-QA框架,把KGQA作为代码生成任务,还构建代码语料库,训练后的模型在KGQA任务中表现优异且泛化性强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24051 2026-07-28 astro-ph.IM cs.AI cs.RO 新提交 57%

HELIOS: An LLM-Driven Autonomous Indirect Trajectory Optimization Agent

HELIOS:一个由大语言模型驱动的自主间接轨迹优化智能体

An-yi Huang

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 研究低推力轨迹优化面临的问题,提出基于大语言模型的HELIOS智能体,能自主进行PMP符号推导等。其创新包括约束自适应推导框架等,实验表明可解决多种轨迹优化问题,验证了模型无关架构及模型规模与推导能力的正相关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21609 2026-07-27 cs.AI 新提交 57%

Coupled Hierarchical Search over Topology and Execution for Agentic Workflow Synthesis

用于智能工作流合成的拓扑与执行耦合分层搜索

Dong Li, Yanchi Liu, Xujiang Zhao, Wei Cheng, Zhengzhang Chen, Xintao Wu, Zhong Chen, Chen Zhao, Haifeng Chen

机构 * Baylor University(贝勒大学) NEC Laboratories America(美国NEC实验室) University of Arkansas(阿肯色大学) Southern Illinois University(南伊利诺伊大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 针对大语言模型结构化工作流创建自动化难题,提出拓扑与执行耦合的搜索范式,引入HierFlow架构,通过反馈引导拓扑调整与树搜索优化子工作流,经多基准测试验证其性能优于基线,平衡了质量与效率且无需额外训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21292 2026-07-24 cs.AI cs.SY eess.SY 新提交 57%

An LLM-Driven Workflow for Automated Process Control Strategy Generation and Tuning from Dynamic Process Models

一种由大语言模型驱动的工作流程,用于从动态过程模型自动生成和调整过程控制策略

Ari Luna Rueda, Eike Cramer, Klaus Hellgardt, Mehmet Mercangöz

机构 * Imperial College London(帝国理工学院) University College London(伦敦大学学院)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 该研究提出由大语言模型驱动的工作流程,用于从动态过程模型自动生成和调整控制策略,将设计任务分解为多步骤,经执行验证和修复,在气体预热器基准测试中生成控制结构与环境,贝叶斯优化降低闭环性能目标约26.5%,证明方法可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20806 2026-07-24 cs.AI 新提交 57%

Profiling Lightweight Large Language Models

轻量级大语言模型剖析

Tomohiro Harada, Enrique Alba, Gabriel Luque

机构 * Graduate School of Science and Engineering, Saitama University(埼玉大学理工学研究科) ITIS, University of Malaga(马拉加大学信息技术与系统研究所)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 研究轻量级大语言模型在资源受限环境中的情况,提出基于PTME的实验框架,通过硬件级测量联合测量精度、时间、内存和能耗,对一组模型进行测试,发现代理描述符不足,揭示非主导配置,为不同资源下选模型提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20483 2026-07-24 cs.AI 新提交 57%

Tractable Hierarchical Control of Autoregressive Language Models

自回归语言模型的可处理分层控制

Max Scribner, Antonio Vergari, Vaishak Belle

机构 * University of Edinburgh(爱丁堡大学)

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI

AI总结 研究如何约束自回归大语言模型生成,核心方法是将其提炼为可处理概率模型,利用有限时长$LR(k)$文法可多项式时间计算满足情况的特性,实现对LLM生成的有效约束与引导,确保输出满足形式句法约束。

Comments 21 pages, 4 figures, 2 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19962 2026-07-23 cs.AI 新提交 57%

EvoThink: Evolving Thinking in Large Reasoning Models via Self-Pruning and Aha-Moment Preference Optimization

EvoThink:通过自剪枝和顿悟时刻偏好优化在大型推理模型中进化思维

Xinbang Dai, Zheyu Xin, Huikang Hu, Lin Ren, Rihui Jin, Guohui Xiao, Guilin Qi, Kuicai Dong, Zhaocheng Du, Yuyang Zhang

机构 * Southeast University(东南大学) Noah’s Ark Lab(诺亚方舟实验室)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 研究针对大型推理模型过度思考问题,提出EvoThink框架,含自剪枝训练和顿悟时刻偏好优化两个关键组件,能减少冗余验证、探索新推理路径,经评估可提高推理效率与能力。

Comments 9 pages, 7 figures, accepted by IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16580 2026-07-21 stat.AP cs.CE cs.SE 新提交 57%

Automating structural reliability analysis with a multi-agent large language model framework

使用多智能体大语言模型框架实现结构可靠性分析自动化

Jaehwan Jeon, Chang Hee Lee, Taeyong Kim

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 研究提出多智能体大语言模型框架,通过专门智能体处理结构可靠性分析流程,用QLoRA微调方法规划器,由确定性求解器计算结果,降低专业知识壁垒,保持计算可信度,实现结构可靠性分析自动化。

Comments 41 pages, 10 figures. Submitted to Automation in Construction

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18026 2026-07-21 cs.AI 新提交 57%

Rethinking Heterogeneous LLM Merging: A Weighted Model Averaging Perspective

重新思考异构语言模型合并:加权模型平均视角

Jiahe Fan, Yinghao Hou, Si Chen, Aiyuan Zhang, Hong Xie, Defu Lian

机构 * University of Science and Technology of China(中国科学技术大学) School of Computer Science and Technology, University of Science and Technology of China(中国科学技术大学计算机科学与技术学院)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 研究异构语言模型合并问题,通过无训练的维度适配和比率控制插值,在联合式与交叉式合并中进行实验,结果表明简单参数平均结合轻量级适配和比率控制是强大基线,揭示直接加权融合的限制及对复杂方法的制约。

Comments 17 pages, 3 figures, 20 tables, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17823 2026-07-21 cs.LG 新提交 57%

Theoretical Foundations of $\max$@$k$ Reinforcement Learning

$\max$@$k$强化学习的理论基础

Riccardo Poiani, Martino Bernasconi, Andrea Celli

机构 * Bocconi University(博科尼大学)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 研究有限 horizon 强化学习中$\max$@$k$学习问题,指出其与标准预期回报最大化不同,证明马尔可夫策略不足,识别状态增强,表征策略性能差距,表明学习更难,给出高效算法实现最优样本复杂度率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16850 2026-07-21 cs.CL 新提交 57%

Group Entropy-Controlled Policy Optimization

组熵控制策略优化

Guangran Cheng, Chengqi Lyu, Songyang Gao, Wenwei Zhang, Kai Chen

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 研究针对大语言模型强化学习中异构任务的探索利用问题,提出组熵控制策略优化(GEPO)方法,利用组熵进行优势塑造,通过实验验证该方法优于GRPO等,能实现跨任务平衡改进并保持任务探索水平。

Comments 16 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16845 2026-07-21 cs.AI 新提交 57%

From Overload to Insights: How AI Agents Can Support Scientists in Analyzing Complex Data

从过载到洞察:人工智能代理如何支持科学家分析复杂数据

Tim Fuchs, Luca Gelisio, Steffen Hauf, Walid Maalej

机构 * European XFEL(欧洲X射线自由电子激光设施)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 针对欧洲XFEL科学家分析复杂数据面临的挑战,设计并评估智能AI系统。采用设计科学研究方法,经多项研究开发并评估两原型,确定关键挑战,得出对AI代理的要求及设计建议,为开发可维护的AI支持提供指导。

Comments Accepted for publication at the 42nd IEEE International Conference on Software Maintenance and Evolution

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16727 2026-07-21 cs.AI cs.CV 新提交 57%

Constraint-Anchored Reasoning Traces

约束锚定推理轨迹

Zehua Cheng, Wei Dai, Jiahao Sun

机构 * University of Oxford(牛津大学)

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI

AI总结 研究自回归多模态大语言模型错误滚雪球问题,提出神经符号框架CART,将自然语言推理与符号约束断言交织,经双管齐下的模块验证约束,防止错误传播,在多基准测试中降低滚雪球率、提高准确率并控制推理开销。

Comments 15 pages, ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16708 2026-07-21 cs.SE 新提交 57%

Model-Driven Discipline for Multi-Agent LLMs: Requirement-to-Verification Generation of Traceable System Models

多智能体大语言模型的模型驱动规范:可追溯系统模型的需求到验证生成

Ran Wei, Le Zhu, Haochi Wang, Ruizhe Yang, Jiapeng Guan, Siyuan Ji, Yuchen Hu, Zhe Jiang, Xiangyang Ji

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 针对软件复杂性问题,提出RADIANT方法,结合MDE与多智能体LLMs用于系统开发。能从需求模型自动生成异构模型及可追溯链接,进行变更影响分析和形式验证。评估显示可提高语法有效性和可执行性,减少开发时间并可跨领域应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16206 2026-07-21 cs.AI 新提交 57%

PPO-HSC: An Exploratory Reinforcement Learning Framework Based on Wide-Area Policy Coverage Optimization

PPO-HSC:基于广域策略覆盖优化的探索性强化学习框架

Yujie Shen, Haowen Chen

机构 * School of Mathematics, Hunan University(湖南大学数学学院) College of Computer Science and Electronic Engineering, Hunan University(湖南大学计算机科学与电子工程学院)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 PPO-HSC是用于解决大语言模型微调中模式崩溃问题的探索性强化学习框架,通过纳入高阶采样覆盖奖励及维护动态轨迹库,提高解决方案多样性与状态空间覆盖,在数学推理和代码生成任务中表现出色。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15099 2026-07-17 cs.SE 新提交 57%

Capturing and Exploiting Design Pattern Variability in Mobile Application Generation

在移动应用生成中捕获和利用设计模式的可变性

Ramón Peralta, Jose-Miguel Horcas

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 研究如何解决移动应用开发中自动代码生成忽视设计原则和架构质量的问题,核心方法是用UVL建模设计模式可变性并结合Jinja模板实现Swift代码生成,利用SPL工程原则,促进了可维护等移动应用的生产。

Comments Research paper presented as a Master's Thesis for the MSc in Advanced Software Technologies for Mobile Devices, Universidad San Jorge (Spain), September 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14709 2026-07-17 cs.CL 新提交 57%

Gold-Guided Programmatic Distillation for Financial Reasoning over Hybrid Tables and Text

用于混合表格和文本的金融推理的黄金引导式程序蒸馏

Yun Dong, Erica Zhao, Elana Chen

专题命中 代码生成 :program synthesis(abstract);分类 cs.CL

AI总结 研究针对混合表格和文本数据的金融推理问题,基于程序蒸馏开发方法,利用黄金推导指导程序合成,经执行验证转移可靠数值推理,引入迭代恢复阶段,实验表明该框架能有效训练小模型进行可靠数值推理。

Comments 12 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15001 2026-07-17 hep-lat cs.AI hep-ph 新提交 57%

LQCDMaster: Agentic Scientific Computing for Lattice Quantum Chromodynamics Research

LQCDMaster:用于格点量子色动力学研究的智能科学计算

Haofei Gao, Tingjia Miao, Wenkai Jin, Muhua Zhang, Hanzhang Wang, Jie Ran, Jinxin Tan, Zhentao Zhang, Bo Tang, Leiyi Li, Jun Hua, Xiangyu Jiang, Qi-An Zhang, Siheng Chen, Wei Wang

机构 * School of Physics and Astronomy(物理与天文学院) Tsung-Dao Lee Institute(李政道研究所) State Key Laboratory of Dark Matter Physics(暗物质物理国家重点实验室) School of Artificial Intelligence(人工智能学院) Zhiyuan College(智远学院) School of Physics(物理学院) SciLand Institute of Quantum Matter(量子物质研究所) Department of Physics(物理系)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 研究针对格点量子色动力学研究实际应用受限问题,提出LQCDMaster智能体,结合智能规划等技术将自然语言任务转化为计算工作流程。经实验评估,其能精确再现多数任务,大幅缩短实现时间,开创智能科学计算范式,促进相关研究。

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12089 2026-07-15 cs.CR cs.SE 新提交 57%

Cross-Cutting Security Analysis of LLM-Generated Code via Metamorphic Testing and Association Rule Mining

通过变形测试和关联规则挖掘对大语言模型生成代码进行横切安全分析

Zedong Peng, Chenggang Wang, Shangyue Zhu

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 研究针对LLM生成代码的安全漏洞,提出结合变形测试与关联规则挖掘的框架,定义九个MRs并应用于3700个代码片段,揭示共同违反结构与横切模式,还进行提示级风险分析,发现不安全代码生成具结构化和提示依赖性,推动相关验证与干预。

Comments This work has already been accepted by IEEE 27th International Conference on Information Reuse and Integration for Data Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11084 2026-07-14 cs.AI 新提交 57%

NVAITC AI Scientist: A Governed End-to-End Research System -- A Hypertension GWAS Case Study

NVAITC人工智能科学家:一个受治理的端到端研究系统——以高血压全基因组关联研究为例

Eddie Huang, Ken Liao, Iven Fu, Yang-Hsien Lin, Chao-Shun Zhan, Andy Liao, Virginia Chen, Johnson Sun, Pika Wang, Richard Huang, Jiun-Cheng Jiang, Ting-Yuan Liu, Hsing-Fang Lu, Ray Y. Lee, Chi-Chou Liao, Simon See, Fuu-Jen Tsai

机构 * Department of Medical Research, China Medical University Hospital(中国医药大学附设医院医学研究部) Master Program for Digital Health Innovation, China Medical University(中国医药大学数字健康创新硕士项目) Laboratory for Statistical and Translational Genetics, RIKEN Center for Integrative Medical Sciences(理化学研究所综合医学科学中心统计与转化遗传学实验室) AI-Driven Genomic Medicine and Drug Discovery Lab, China Medical University Hospital(中国医药大学附设医院人工智能驱动的基因组医学与药物发现实验室)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 研究以高血压GWAS为例,介绍受治理的端到端智能研究系统NAIS,其集成多种功能。通过真实数据验证,NAIS能支持生物医学发现,规划队列提取等,重现高血压基因座,在药物性肝损伤预测中也有成果,可产生与专家主导流程相当的输出。

Comments 22 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10210 2026-07-14 cs.CR cs.CL 新提交 57%

Toward Stronger Code Watermarking: A Grammar-Driven Approach to Optimizing the Trade-off Between Quality and Detectability

迈向更强的代码水印:一种语法驱动的方法来优化质量与可检测性之间的权衡

Licheng Yu, Aiwei Liu, Songze Li

机构 * Southeast University(东南大学) Tsinghua University(清华大学)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 针对大语言模型代码生成中质量与可检测性权衡难题,提出语法驱动水印方法(GDW),通过语法引导机制和角色感知调制注入水印,设计加权检测统计量,实验表明其在多方面优于现有方法且具鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10295 2026-07-14 physics.optics cs.AI 新提交 57%

Program-Synthesis-Driven Autodesign of Universal Unitary Operators

程序合成驱动的通用酉算子自动设计

Yifei Zhang, Dong Chen, Fan Wang, Wenrui Zhang, Yan Chen, Dingding Han, Jianmin Yuan, Xiangjin Kong, Yu-Gang Ma

机构 * Key Laboratory of Nuclear Physics and Ion-beam Application (MOE), Institute of Modern Physics, Fudan University, Shanghai 200433, China(核物理与离子束应用重点实验室(教育部),现代物理研究所,复旦大学,上海200433,中国) Research Center for Theoretical Nuclear Physics, NSFC and Fudan University, Shanghai 200438, China(理论核物理研究中心,国家自然科学基金委员会和复旦大学,上海200438,中国) Huawei Technologies Co., Ltd, Beijing 100095, China(华为技术有限公司,北京100095,中国) Department of Industrial Engineering and Decision Analytics, Hong Kong University of Science and Technology, HongKong, China(工业工程与决策分析系,香港科技大学,香港,中国) Hunan Key Laboratory of Mechanism and Technology of Quantum Information, Changsha 410073, China(湖南量子信息机制与技术重点实验室,长沙410073,中国) School of Information Science and Technology, Fudan University, Shanghai 200433, China(信息科学与技术学院,复旦大学,上海200433,中国) Research Institute of Intelligent Complex Systems, Fudan University, Shanghai 200433, China(智能复杂系统研究所,复旦大学,上海200433,中国) Institute of Atomic and Molecular Physics, Jilin University, Changchun 130012, China(原子与分子物理研究所,吉林大学,长春130012,中国) School of Physics, East China Normal University, Shanghai 200062, China(物理学院,华东师范大学,上海200062,中国)

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI

AI总结 研究利用人工智能驱动的程序合成,通过扩展DreamCoder到复值线性代数,发现光子网络中酉矩阵分解策略,其生成的程序编码与维度无关的不变量及构造规则,还能利用矩阵结构减少干涉仪数量,为酉算子自动设计提供可扩展范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09072 2026-07-13 cs.SE 新提交 57%

Agentic Proof and Property-Based Testing via Property-Templates in Data-Intensive Computing

通过数据密集型计算中的属性模板进行智能体证明和基于属性的测试

Seongmin Lee, Yaoxuan Wu, Miryung Kim

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 研究软件工程中意图规范和验证问题,提出用属性模板解决验证候选属性和实施PBT的子问题,设计智能体双轨验证框架,经评估该框架能提高证明成功率、减少幻觉、降低成本并提升代码覆盖,还能发现模型与实现差距。

Comments 12 pages, 7 figures, 4 tables; supplementary material included as ancillary file

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08885 2026-07-13 cs.SE 新提交 57%

Programmers Are Poor and Overconfident Judges of LLM-Generated Assertions

程序员是大型语言模型生成断言的糟糕且过度自信的评判者

Zhanna Kaufman, Yuriy Brun, Adithya Murali, Madeline Endres

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 研究程序员评估大型语言模型生成断言的能力,通过实验发现程序员判断正确断言较准,判断错误断言较差,自然语言解释未带来整体益处,凸显帮助开发者评估机器生成可靠性工件的重要性。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07952 2026-07-10 cs.HC cs.CL 新提交 57%

fog: Expressing Motion and Emotion through Function Composition of AI-Generated Code

fog:通过人工智能生成代码的函数组合来表达运动和情感

Vivian Liu, Lydia Chilton

机构 * Columbia University(哥伦比亚大学)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 介绍fog函数组合框架,用于通过人工智能生成代码表达运动和情感,能创建运动词汇表并由动画编辑器辅助。经感知评估和用户研究,其运动函数识别准确率达68%,相比基线有显著提升,且在界面形式上支持用户快速迭代等。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06519 2026-07-08 cs.AI 新提交 57%

FreqDepthKV: Frequency-Guided Depth Sharing for Robust KV Cache Compression in Long-Context LLM Inference

FreqDepthKV:用于长上下文语言模型推理中稳健的键值缓存压缩的频率引导深度共享

Anna Córdoba, Adam Puente Tercero, Nerea Angulo Hijo, Mar Linares Tercero, Julia Barrientos, Ainhoa Miranda, Jesús Olivera

机构 * Instituto de Investigación en Visión Artificial(人工视觉研究所)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 研究针对长上下文语言模型推理中键值缓存成本问题,提出FreqDepthKV方法,将相邻层键值状态分解,通过在线探测器分配缓存模式,在多基准测试中保持任务准确性,提升解码吞吐量并降低内存,实现高效压缩。

Comments 11 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05659 2026-07-08 cs.SE 新提交 57%

Agents with Feelings? Personality and Emotion in Multi-Agent Software Teams

有情感的智能体?多智能体软件工程团队中的个性与情感

Yunyan Ding, Thomas Zimmermann, Iftekhar Ahmed

专题命中 代码生成 :code generation(abstract);分类 cs.SE

AI总结 研究多智能体软件工程团队中个性和情绪特征对团队绩效的影响,采用结合多种因素的心理学框架,通过对78种团队配置评估发现配置显著影响性能、协作及成本,表明智能体配置是重要设计维度。

详情

展开后加载摘要…

URL PDF HTML 收藏