arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-24 至 2026-07-24 共收录 145 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 20 篇

2607.21324 2026-07-24 cs.CL cs.AI 新提交 85%

GRADRAG: Cross-Component Prompt Adaptation for Coordinated Multi-Agent RAG

GRADRAG:用于协调多智能体RAG的跨组件提示适应

Paolo Pedinotti, Enrico Santus

机构 * Bloomberg(彭博社)

专题命中 多智能体 :agent(title);multi-agent(title);分类 cs.AI、cs.CL

AI总结 研究针对多智能体RAG系统各组件孤立优化问题,提出GRADRAG框架,通过将RAG流程建模为计算图,传播评估反馈更新上游智能体,在两种检索范式基准测试中优于单步细化基线,提升了系统性能。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20501 2026-07-24 cs.AI cs.MA 新提交 84%

MKEvolve: A Modular Multi-Agent Framework for Kernel Code Generation

MKEvolve:用于内核代码生成的模块化多智能体框架

Jason Yoo, Rajarshi Saha, Shaowei Zhu, Tao Yu, Wei Tang, Youngsuk Park

专题命中 多智能体 :agent(title);multi-agent(title);分类 cs.AI

AI总结 针对硬件加速器内核代码生成瓶颈,MKEvolve框架通过迭代共同进化PyTorch模块分解与子模块内核,经拆分融合优化分解并以束搜索改进子内核,实验证明其在正确性、加速及减少LLM令牌使用上有优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20428 2026-07-24 cs.CL cs.HC cs.MA 新提交 77%

Human-in-the-Loop Large Language Model Framework for Identification of Cutaneous Immune-Related Adverse Events

用于识别皮肤免疫相关不良事件的人在回路大语言模型框架

Charles Lu, Olivia Burke, Debby Cheng, Adam Kashlan, Caitlyn Duffy, Zeyun Lu, Lirit Fuksman, Jin Ning Tian, Andrew Sedlack, Priya Katyal, Eudora Lee, Ralina Karagenova, Chuck Lin, Kun-Hsing Yu, Nicole LeBoeuf, Alexander Gusev, Yevgeniy R. Semenov

专题命中 多智能体 :agent(abstract);workflow(abstract);multi-agent(abstract);分类 cs.CL

AI总结 研究旨在通过人在回路的大语言模型框架检测皮肤免疫相关不良事件,采用检索增强等方法,相比人工审查提高了准确性、一致性并缩短审查时间,还试点了大语言模型在跨器官系统识别免疫毒性及数据提取方面的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21488 2026-07-24 cs.LG cs.AI cs.MA cs.RO 新提交 73%

Compact Latent Coordination for Autonomous Vehicles at Unsignalized Intersections

无信号交叉口自动驾驶车辆的紧凑潜在协调

Gil Lifshits, Igal Bilik, Gilad Katz

机构 * Ben-Gurion University of the Negev(内盖夫本古里安大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 针对无信号交叉口自动驾驶车辆协调难题提出MAPS分层DRL架构,主智能体生成编码全局策略的原型计划,工作智能体结合局部观测执行控制。实验表明MAPS能实现无碰撞导航、减少行驶时间,且原型计划泛化能力强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21210 2026-07-24 cs.LO cs.AI cs.MA 新提交 70%

Explainable Belief Harmonization under Dynamic Epistemic Partitions

动态认知分区下的可解释信念协调

Adam Kostka, Jarosław A. Chudziak

机构 * Warsaw University of Technology(华沙技术大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究多智能体信念组合中认知分区的运行时变化,提出结合回答集编程与Python的混合方法框架,能处理异构分辨率级别,保证可接受性、修复及解释完整性,经评估可实现完全违规检测和解释覆盖。

Comments In Proceedings ICLP 2026, arXiv:2607.17707

Journal ref EPTCS 450, 2026, pp. 529-543

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20674 2026-07-24 cs.LG cs.SY eess.SY math.OC 新提交 70%

End-to-End Learning of Safe Optimal Feedback Control in High Dimensions with Control Barrier Function Layers

基于控制障碍函数层的高维安全最优反馈控制的端到端学习

Xingjian Li, Kelvin Kan, Deepanshu Verma, Krishna Kumar, Stanley Osher, Samy Wu Fung

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 研究在硬安全约束下高维半全局反馈控制器的学习问题,结合算子分裂与无雅可比反向传播方法,实现可扩展端到端训练并保持安全保证,证明该方法在高维多智能体非线性控制问题上的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 15 篇

2607.20999 2026-07-24 cs.AI 新提交 88%

Workflow-Localized Mechanism Learning: Attribution-Guided Repair and Knowledge Reuse for Structured Agent Skills

工作流局部机制学习:结构化智能体技能的归因引导修复与知识重用

Zibin Lin, Shengli Zhang, Taotao Wang, Yihan Xia, Deen Ma, Guofu Liao

机构 * SZU(深圳大学)

专题命中 工作流自动化 :agent(title,abstract);workflow(title,abstract);分类 cs.AI

AI总结 研究针对智能体技能中工作流故障问题,引入工作流局部机制学习(WML)。其节点 - 机制归因可识别故障节点等,再经工作流引导技能优化(WGSO)循环处理。在多个数据集上实验,WML取得较好准确率、通过率等,还减少了令牌和调用。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17528 2026-07-24 cs.AI cs.AR cs.LG 版本更新 86%

Can AI Agents Really Complete RTL-to-GDS? Lessons from Benchmarking Tool-Interactive EDA Workflows

人工智能代理真的能完成从RTL到GDS的转换吗?基准测试工具交互式EDA工作流程的经验教训

Jinyuan Deng, Zhengrui Chen, Xufeng Wei, Tianyu Xing, Chenyi Wen, Qi Sun, Cheng Zhuo

专题命中 工作流自动化 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究探讨人工智能代理在EDA工作流程中的表现,提出FluxBench进行系统评估,涵盖多种场景并评估多项能力,引入Token ROI指标。结果显示不同代理系统架构性能有差距,特定领域技能不是提升性能的唯一关键,系统设计和基础模型能力也很重要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10161 2026-07-24 q-bio.GN 版本更新 85%

Omics Data Discovery Agents: Agent-Supported Retrieval, Reanalysis, and Synthesis of Published Omics Data

组学数据发现代理

Alexandre Hutton, Jesse G. Meyer

专题命中 工作流自动化 :agent(title,abstract);workflow(abstract);agentic(abstract)

AI总结 本文提出了一种基于代理的框架,通过自动化提取和处理组学数据,实现对生物医学文献的可执行查询和大规模数据重用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20503 2026-07-24 cs.AI cs.LG cs.LO 新提交 84%

LeanFlow: A Case Study in Workflow-Driven Lean Autoformalization

LeanFlow:工作流驱动的精益自动形式化案例研究

Lazar Milikic, Simon Guilloud, Khanh Nguyen, Viktor Kuncak

机构 * Moonshot AI(月球计划人工智能公司) epfl-lara(洛桑联邦理工学院拉腊实验室)

专题命中 工作流自动化 :workflow(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 研究通过对两篇数学论文案例研究,探讨文档到项目形式化中运行时机制对相关指标的影响,使用Kimi2.6和GPT5.5进行消融实验,报告多项数据,展示LeanFlow在特定任务上的表现及校准成果。

Comments 14 pages, 3 figures, ICML 2026: AI for Math Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21345 2026-07-24 cs.AI 新提交 79%

Regulating autonomous and agentic AI

规范自主和智能代理人工智能

Chris Reed, Alex Austria, Anmol Bharuka, Pragnitha Mandava, Khushiya Mujawar, Luka Shakhkulashvili

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 研究规范自主和智能代理人工智能活动的挑战,通过分析英国内容平台监管等四种监管系统,提出潜在解决方案,助力将监管从被动转为主动,以适应人工智能自主性挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21292 2026-07-24 cs.AI cs.SY eess.SY 新提交 79%

An LLM-Driven Workflow for Automated Process Control Strategy Generation and Tuning from Dynamic Process Models

一种由大语言模型驱动的工作流程,用于从动态过程模型自动生成和调整过程控制策略

Ari Luna Rueda, Eike Cramer, Klaus Hellgardt, Mehmet Mercangöz

机构 * Imperial College London(帝国理工学院) University College London(伦敦大学学院)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI

AI总结 该研究提出由大语言模型驱动的工作流程,用于从动态过程模型自动生成和调整控制策略,将设计任务分解为多步骤,经执行验证和修复,在气体预热器基准测试中生成控制结构与环境,贝叶斯优化降低闭环性能目标约26.5%,证明方法可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08532 2026-07-24 cs.AI 版本更新 74%

DN-Hypo-Pipeline: An AI-Driven Workflow for Generating Hypotheses using Large Language Models and Scientific Explanations

DN-Hypo-Pipeline:一种基于大语言模型和科学解释的AI驱动假设生成工作流

Lei Lin, Xinlong Pan, Ronghao Wang, Chunbao Zhou, Jue Wang, Yangang Wang, Ivana Rasovska

机构 * Computer Network Information Center, Chinese Academy of Sciences, China(中国科学院计算机网络信息中心)

专题命中 工作流自动化 :workflow(title);分类 cs.AI

AI总结 提出DN-Hypo-Pipeline,利用大语言模型和科学解释作为先验知识,从现有文献中推导新假设,在数据科学建模中通过统计推断和专家评估证明优于直接生成方法,并验证了生成假设对应的算法性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20453 2026-07-24 cs.CL cs.AI cs.LG 新提交 67%

A Knowledge-Injection Framework for Zero-Shot Adaptation of LLMs to Delirium Prediction

一种用于将大语言模型零样本适应谵妄预测的知识注入框架

Jessica Sena, Shesadree Priyadarshani, Miguel Contreras, Bharat Gandhi, Scott Siegel, Subhash Nerella, Parisa Rashidi

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对大语言模型零样本适应谵妄预测中领域知识不足问题,提出轻量级知识注入框架。在推理时用外部临床知识报告增强数据摘要,无需微调或检索。实验表明该方法能提升模型性能,缩小与前沿模型差距,且收益依赖临床意义内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21117 2026-07-24 cs.LG cs.AI 新提交 62%

GlucoTune: A Unified Framework for Blood Glucose Preprocessing, Forecasting, and Benchmarking in Diabetes

GlucoTune:糖尿病血糖预处理、预测及基准测试的统一框架

Davide Marelli, Giorgia Rigamonti, Mirko Paolo Barbato, Paolo Napoletano

机构 * Department of Informatics, Systems and Communication, University of Milano-Bicocca(米兰比可卡大学信息、系统与通信系)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 GlucoTune框架解决糖尿病血糖数据预处理等缺乏标准流程与评估协议问题,通过可配置管道实现可重复预处理,提供统一接口和基准测试排行榜,集成数据集,经实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21307 2026-07-24 cs.LO cs.AI cs.ET 新提交 57%

Scaling Up Formal Representation of Clinical Trial Protocols in Ensemble Logic Using LLMs: A Preliminary Study

使用大语言模型在集成逻辑中扩大临床试验协议的形式化表示:一项初步研究

Yan Huang, Xubing Hao, Xiaojin Li, Rashmie Abeysinghe, Xiaoqian Jiang, Licong Cui, Guo-Qiang Zhang

机构 * McGovern Medical School(麦戈文医学学院) McWilliams School of Biomedical Informatics(麦克威廉斯生物医学信息学学院) The University of Texas Health Science Center at Houston(德克萨斯大学健康科学中心休斯顿分校)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究针对临床试验协议依赖非结构化文本阻碍自动化推理等问题,引入CT-TEL工作流程,利用大语言模型将叙述性临床协议转为TEL公式,通过反向翻译评估保真度,为协议映射到可计算逻辑及临床试验模拟提供初步证据。

Comments Proceedings of the 2026 American Medical Informatics Association Symposium, to appear

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20592 2026-07-24 cs.LG 新提交 57%

STeMP: Spatio-Temporal Modelling Protocol

STeMP:时空建模协议

Jan Linnenbrink, Jakub Nowosad, Marvin Ludwig, Anna Frederike Jablotschkin, Fabian Schumacher, Teja Kattenborn, Hanna Meyer

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 研究针对时空建模缺乏标准协议的问题,提出STeMP协议,通过标准化报告助于理解模型功能并在建模过程中提供指导,涵盖概述、模型和预测三部分,配套R包及网络应用,可辅助填写协议并返回警告,鼓励社区参与。

Comments 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20889 2026-07-24 cs.CV 新提交 50%

Engine-Native Editable 3D World Reconstruction with Objects and Lighting

使用对象和光照进行引擎原生可编辑3D世界重建

Junhao Chen, Xinghao Chen, Henghaofan Zhang, Zihao Qiao, Saining Zhang, Yongzhi Li, Ruqi Huang, Sisi Li, Yimin Sheng, Jianyi Zhu, Hao Zhao

机构 * Tsinghua University(清华大学) Nankai University(南开大学) University of Electronic Science and Technology of China(电子科技大学) Sun Yat-sen University(中山大学) Nanyang Technological University(南洋理工大学)

专题命中 工作流自动化 :agentic(abstract)

AI总结 研究旨在实现引擎原生可编辑3D世界重建。核心方法是引入Lumera管道,基于Lumera-2K数据,用Lumera-Box和Lumera-Light解析相关元素并组装。主要贡献是确立参数化灯光目标,揭示多方面剩余瓶颈,且在检测等方面取得一定分数。

Comments 18 pages, 7 figures, Project Page: https://haidilao0328.github.io/Lumera/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20873 2026-07-24 cs.IR 新提交 50%

LO-FAR: A Cost-Aware Local Filter for Sparse Feature Ranking in Industrial Ad Recommendation

LO-FAR:工业广告推荐中用于稀疏特征排序的成本感知局部过滤器

Egemen Erbayat, Luis Duque, Sohini Roychowdhury, Mohammad Amin, Srihari Reddy

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究工业广告推荐中稀疏特征排序问题,提出仅用CPU的LO-FAR工作流程,通过轻量级局部估计器排序,在生产数据集上约两小时完成排序,保留下游归一化熵增益,证明简单局部过滤器在成本和周转约束下是实用生产选择。

Journal ref RecSys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21295 2026-07-24 math.NA cs.NA physics.comp-ph physics.flu-dyn 新提交 50%

An unfitted boundary algebraic equation method with Calderón preconditioning for 2D Stokes flow in irregular geometry

一种用于不规则几何中二维斯托克斯流的具有卡尔德隆预处理的非拟合边界代数方程方法

Wenjun Ying, Qing Xia

专题命中 工作流自动化 :workflow(abstract)

AI总结 该研究针对不规则几何中二维斯托克斯流,提出非拟合边界代数方程方法。通过构建特定格林函数,经局部插值等操作求解。利用离散卡尔德隆预处理器,实现二阶收敛,降低条件数,在多种场景验证有效性,解决了相关数值模拟问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19741 2026-07-24 math.NA cs.NA 版本更新 50%

Intrinsic Low-Tucker-Rank Theory and Unified Tensor CUR Decomposition for High-Dimensional Hyperinterpolation

高维超插值的内在低塔克秩理论与统一张量CUR分解

Maolin Che, Yimin Wei, Chong Wu

专题命中 工作流自动化 :workflow(abstract)

AI总结 针对高维超插值受维度诅咒问题,本文建立内在低塔克秩理论,构建统一理论框架,验证贪婪自适应索引选择方案特性,提出实用算法和管道,通过实验证实超插值系数低秩可压缩性,为其奠定统一结构和数学基础。

Comments 48 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 12 篇

2607.21495 2026-07-24 cs.AI cs.ET cs.MA 新提交 88%

Toward Continuous Assurance for the Democratization of AI Agent Creation in Industry

迈向工业中人工智能代理创建民主化的持续保障

Natan Levy, Harel Berger

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 针对工业中人工智能代理创建民主化带来的可靠性挑战,提出轻量级持续保障框架,结合依赖映射等多种方法评估代理运行状态,还展示了原型审核器及评估,为公民创建的组织代理提供保障。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03316 2026-07-24 cs.SE cs.AI 版本更新 84%

Is Agentic Code Review Helpful? Mining Developers' Feedback to CodeRabbit Reviews in the Wild

智能代码审查有用吗?挖掘开发者对CodeRabbit在实际应用中代码审查的反馈

Hong Yi Lin, Mingzhao Liang, Patanamon Thongtanunam, Kla Tantithamthavorn

机构 * The University of Melbourne(墨尔本大学) Monash University(莫纳什大学)

专题命中 软件智能体 :agentic(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.SE

AI总结 以CodeRabbit为例对智能代码审查进行实证研究,通过大量代码审查与开发者反馈数据,揭示其审查结果及被拒原因,还探索预测审查被拒的方法,指出改进空间与不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19605 2026-07-24 cs.SD 版本更新 82%

RIME: Enabling Large-Scale Agentic Music Post-Production

RIME:实现大规模智能后期制作

Noah Schaffer, Nikhil Singh

机构 * Dartmouth College(达特茅斯学院)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract)

AI总结 研究针对音乐后期制作问题,引入RIME框架,利用POEMS工具包生成配对数据,评估多模态语言模型,展示其通过监督微调提升智能体性能,是迈向迭代音乐智能体、变革音乐制作的早期步骤。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05385 2026-07-24 cs.IR cs.AI 版本更新 79%

TeaRAG: A Token-Efficient Agentic Retrieval-Augmented Generation Framework

TeaRAG:一种令牌高效的智能检索增强生成框架

Chao Zhang, Yuhao Wang, Derong Xu, Haoxin Zhang, Yuanjie Lyu, Yuhao Chen, Shuochen Liu, Tong Xu, Xiangyu Zhao, Yan Gao, Yao Hu, Enhong Chen

机构 * University of Science and Technology of China(中国科学技术大学) City University of Hong Kong(香港城市大学) Xiaohongshu Inc.(小红书公司)

专题命中 软件智能体 :agentic(title,abstract);分类 cs.AI

AI总结 研究提出TeaRAG框架解决智能RAG令牌开销大问题,通过基于简洁三元组的图检索压缩检索内容,用IP-DPO减少推理步骤,在多个数据集上实验,提高了平均精确匹配,减少了输出令牌。

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12144 2026-07-24 cs.CV cs.RO eess.IV 版本更新 78%

O3N: Omnidirectional Open-Vocabulary Occupancy Prediction for Urban Autonomous Agents

O3N: 全向开放词汇占用预测

Mengfei Duan, Hao Shi, Fei Teng, Guoqiang Zhao, Yuheng Zhang, Zhiyong Li, Kailun Yang

机构 * Hunan University(湖南大学) Zhejiang University(浙江大学)

专题命中 软件智能体 :autonomous agent(title,abstract)

AI总结 O3N通过全向感知和开放词汇方法,实现三维空间的连续表示和长距离上下文建模,提升具身智能在开放世界中的感知与建模能力。

Comments The source code will be made publicly available at https://github.com/MengfeiD/O3N

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21217 2026-07-24 cs.AI 新提交 77%

ICAE-Bench: Evaluating Coding Agents as Interactive Project Builders

ICAE-Bench:将编码智能体评估为交互式项目构建者

Zhongyuan Peng, Dan Huang, Chuyu Zhang, Caijun Xu, Changyi Xiao, Shibo Hong, David Lo, Lin Qiu, Xuezhi Cao, Jiyuan He, Yixin Cao

机构 * Meituan(美团)

专题命中 软件智能体 :agent(abstract);tool use(abstract);planning(abstract);分类 cs.AI

AI总结 研究针对编码智能体在交互式项目构建中作用转变,现有基准未跟上的问题,提出ICAE-Bench基准。从模糊需求出发,经自动化用户智能体模拟动态范式,引入避免需求模糊性、确保用户模拟质量、公平评估开放式仓库的关键设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20759 2026-07-24 cs.CR cs.AI cs.SE 新提交 73%

IssueTrojanBench: Benchmarking AI Coding Agents Against Malicious Issue Requests

IssueTrojanBench:针对恶意问题请求对人工智能编码代理进行基准测试

Ankur Singh, Jinqiu Yang, Tse-Hsun Chen

机构 * Concordia University(康科德大学)

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 研究针对恶意问题请求对人工智能编码代理进行基准测试,通过构建包含多种攻击类别和交付向量的新型基准IssueTrojanBench,发现现代编码代理存在关键漏洞,强调需更强安全机制保护。

Comments 10 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20972 2026-07-24 cs.AI cs.SE 新提交 62%

Delivery, Not Storage: Cue-Anchored Working Memory as a Harness Property for Coding Agents

传递而非存储:线索锚定工作记忆作为编码代理的一种约束属性

Swapnanil Saha

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 研究编码代理记忆问题,提出基于认知文献的两层设计理论及线索锚定记忆模型,通过实际编码任务评估,表明传递而非存储是关键,可靠记忆通道应让代理无需思考,给出相关实验结果及贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20908 2026-07-24 cs.LG cs.AI 新提交 62%

Multi-turn RL with Structural and Performance Aware Rewards for CUDA Kernel Generation

用于 CUDA 内核生成的具有结构和性能感知奖励的多轮强化学习

Quazi Ishtiaque Mahmud, Nesreen K. Ahmed, Ali Jannesari

机构 * Iowa State University(爱荷华州立大学) Cisco AI Research(思科人工智能研究院)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.LG

AI总结 研究针对 CUDA 内核生成,提出 CudaPerf 框架,结合可验证执行奖励与结构代码感知奖励,分离线排序和在线训练两阶段,利用执行反馈迭代细化,通过实验证明其显著优于基线,在加速和正确性上有大幅提升。

详情

展开后加载摘要…

URL PDF HTML 收藏