arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-03 至 2026-08-03 共收录 167 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 21 篇

2607.28836 2026-08-03 cs.ET cs.MA cs.NI 新提交 67%

The AnyLog Edge Data Fabric

AnyLog 边缘数据架构

Roy Shadmon, Mark Davidson, Eric Aquaronne, Massimiliano Pinto, Ori Shadmon, Moshe Shadmon

专题命中 工作流自动化 :agent(abstract);AI agent(abstract)

AI总结 本文提出 AnyLog 边缘数据架构,该基于智能体与边缘的平台可在源端管理运营数据,通过多项技术让用户无需知晓资源位置即可操作分布式资源,为分布式 SQL 等提供类云操作模式,无单点故障且不依赖集中式基础设施。

Comments Keywords: IoT Data Management, Edge Data Management, Edge Data Fabric, Distributed Query, Edge AI, P2P Data Layer, Decentralized Data Layer. 30 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29383 2026-08-03 cs.LG cs.DC cs.SE 新提交 62%

Exploring Block Anomaly Detection In HDFS Log Data Analysis

HDFS日志数据分析中的块异常检测探索

WenYang Zhong, Tutut Herawan

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG、cs.SE

AI总结 本研究针对HDFS日志人工异常检测复杂枯燥的问题,提出结合LLM-BiLSTM模型与Kafka流式管道的检测方案,实现HDFS块异常的快速准确检测。

Comments 37 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28666 2026-08-03 cs.CL cs.LG 新提交 62%

The Checking Problem: What must be true before AI ships in a regulated firm

核查问题:受监管企业在AI产品交付前必须满足什么条件

Prerit Ahuja

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL、cs.LG

AI总结 本文研究受监管金融服务领域AI项目停滞的机制,通过多模型多配置实验发现,AI工作流价值更多取决于人类审核量,而非正确率,且审核负担可通过样本外估算测量。

Comments 10 pages, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08804 2026-08-03 cs.CY cs.CL cs.LG 62%

Estimating Item Difficulty Using Large Language Models and Tree-Based Machine Learning Algorithms

利用大语言模型和基于树的方法进行项目难度估计

Pooya Razavi, Sonya Powers

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL、cs.LG

AI总结 本研究利用大语言模型和基于树的方法预测K-5数学和阅读评估项目的难度,发现基于特征的方法在预测准确性上优于直接估计方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28671 2026-08-03 stat.AP cs.LG 新提交 57%

Fracture Risk Prediction in Adults Over 50 Years Old Using DXA and EHR: Comparison of Traditional and Machine Learning Models in Two Large Cohorts

利用DXA和EHR预测50岁以上成人骨折风险:两个大型队列中传统模型与机器学习模型的比较

Jiahe Qian, Hao Dai, Kunyu Yu, Hexin Dong, Xing He, Erik A. Imel, Jiang Bian, Yifan Peng, Yi Liu

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 该研究针对50岁以上成人,基于EHR和DXA数据构建多种生存预测模型,发现其区分度优于FRAX,为骨折风险预测提供了更优工具,但需进一步评估后才可临床应用。

Comments 5 figures, 4 tables, 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29519 2026-08-03 cs.SE 新提交 57%

Students' Practices and Skills in the LLM-Era: "You Can't Outsource the Struggle and Still Get the Skill"

LLM时代的学生实践与技能:“你不能把奋斗过程外包出去,却仍想获得技能”

Enne Rebeca Silva de Freitas, Gustavo Pinto, Danilo Monteiro

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 研究针对软件工程研究生在LLM时代的AI使用技能缺口,分析1383条子reddit帖子后发现学生外包研究技能培养的认知努力,提出需开发课程引导学生与LLM协同工作。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29087 2026-08-03 cs.AI 新提交 57%

Harnessing the Wisdom of LLM Crowds through Complementarity-Driven Iterative Collaboration

通过互补驱动的迭代协作挖掘大语言模型群体的智慧

Yanbin Fang, Xuan Wei, Wei Chen

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 该研究针对现有LLM组合方法忽略动态互补性的问题,提出WILC框架,通过迭代反思优化与双门互补模型选择机制,在四个基准上性能优于现有方法,成本仅为GPT-5.2的约1/7,扩展了群体智慧理论并提供多AI协调设计原则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02906 2026-08-03 cs.LG 版本更新 57%

OpsLLM: Construction of Large Language Model for Software Operations with Multi-stage Learning

面向软件运维构建大型语言模型的端到端框架

Jingkai He, Pengfei Chen, Chenghui Wu, Shuang Liang, Ye Li, Gou Tan, Xidao Wen, Chuanfu Zhang, Fang Situ, Qi Zhou

机构 * School of Systems Science and Engineering, Sun Yat-sen University(系统科学与工程学院,中山大学) School of Computer Science and Engineering, Sun Yat-sen University(计算机科学与工程学院,中山大学) Alibaba Cloud Computing(阿里云 computing)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出OpsLLM,一个专为软件运维设计的大型语言模型,支持基于知识的问题回答和根本原因分析。通过人机协同机制构建高质量数据集,并结合监督微调和强化学习优化模型性能,在多个任务中优于现有开源和闭源模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28978 2026-08-03 cs.CV 新提交 50%

Classification of COVID-19 cases from chest CT volumes using hybrid model of 3D CNN and 3D MLP-Mixer

基于3D CNN与3D MLP-Mixer混合模型的胸部CT影像的COVID-19病例分类

Masahiro Oda, Tong Zheng, Yuichiro Hayashi, Yoshito Otake, Masahiro Hashimoto, Toshiaki Akashi, Shigeki Aoki, Kensaku Mori

机构 * Nagoya University(名古屋大学) Graduate School of Informatics, Nagoya University(名古屋大学信息学研究科) Graduate School of Science and Technology, Nara Institute of Science and Technology(奈良先端科学技术大学院大学科学技术研究科) Research Center for Medical Bigdata, National Institute of Informatics(信息学研究所医疗大数据研究中心) Keio University School of Medicine(庆应义塾大学医学院) Juntendo University(顺天堂大学)

专题命中 工作流自动化 :workflow(abstract)

AI总结 针对COVID-19患者激增导致的医疗人力短缺问题,本文提出由3D CNN与3D MLP-Mixer组成的混合模型,在含1205份CT影像的数据集上取得79.5%的分类准确率,优于传统3D CNN模型。

Comments Accepted as a poster presentation in SPIE Medical Imaging 2023

Journal ref Proceedings of SPIE Medical Imaging 2023, Computer-Aided Diagnosis, Vol. 12465

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28950 2026-08-03 cs.CV 新提交 50%

Automated classification method of COVID-19 cases from chest CT volumes using 2D and 3D hybrid CNN for anisotropic volumes

基于2D和3D混合卷积神经网络的各向异性体积胸部CT影像COVID-19病例自动分类方法

Masahiro Oda, Tong Zheng, Yuichiro Hayashi, Yoshito Otake, Masahiro Hashimoto, Toshiaki Akashi, Shigeki Aoki, Kensaku Mori

机构 * Nagoya University(名古屋大学) Keio University School of Medicine(庆应义塾大学医学院) Juntendo University(顺天堂大学)

专题命中 工作流自动化 :workflow(abstract)

AI总结 该研究针对COVID-19诊断需求,提出含2D/3D混合特征提取流的CNN,在1288例CT数据集上实现83.3%的平均分类准确率,优于无混合流的CNN,可辅助缓解医疗人力短缺。

Comments Oral Presentation in SPIE Medical Imaging 2022

Journal ref Proceedings of SPIE Medical Imaging 2022, Computer-Aided Diagnosis, Vol. 12033

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28868 2026-08-03 cs.CV 新提交 50%

Physics-Aligned Self-Supervised Learning for Scientific Imaging

面向科学成像的物理对齐自监督学习

Bashir Kazimi, Stefan Sandfeld

机构 * Institute for Materials Data Science and Informatics (IAS-9), Forschungszentrum Jülich GmbH(于利希研究中心材料数据科学与信息学研究所(IAS-9))

专题命中 工作流自动化 :workflow(abstract)

AI总结 本研究针对科学成像的物理测量特性,提出了一套物理对齐的自监督学习增强设计流程,在五种SSL范式的分类和回归任务中显著提升了下游性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28853 2026-08-03 cs.HC 新提交 50%

Spatial Visual Analytics for Multi-Document Summary Verification

面向多文档摘要验证的空间视觉分析技术

Jiahao Xu, Wei Liu, Yang Liu, Eric Krokos, Kirsten Whitley, Xuan Wang, Rebecca Faust, Chris North

专题命中 工作流自动化 :workflow(abstract)

AI总结 该研究针对多文档摘要验证难题,提出SVS视觉分析系统,含两种二维布局,实验表明其可提升验证准确性、降低工作量,SUMMARY-GUIDED布局综合表现最优。

Comments Accepted to IEEE VIS 2026; 13 pages, including appendices (11-page paper plus 2-page appendices)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29471 2026-08-03 physics.optics physics.data-an 新提交 50%

Tomographic Phase Imaging with Randomized Probe Imaging

基于随机探针成像的断层相位成像

Jordan T. O'Neal, Byeongdu Lee, Soenke Seifert, Hanna Ruth, Michael Wojcik, Haidan Wen, Yanqi Luo, Yi Jiang, Junjing Deng

专题命中 工作流自动化 :workflow(abstract)

AI总结 该研究首次将随机探针成像(RPI)应用于断层相位成像,实现了亚100 nm分辨率的立方金纳米颗粒三维成像,相比ptychography大幅提速且结果高度一致。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20795 2026-08-03 quant-ph 版本更新 50%

Component-Level Inverse Design of Transmon Qubits Using Neural Networks

使用神经网络的跨导量子比特组件级逆设计

Olivia Seidel, Firas Abouzahr, Abhishek Chakraborty, Sadman Ahmed Shanto, Saikat Das, Daniel Baxter, Jonathan Asaadi, Nicola Pancotti, Haoyu Yang, Brucek Khailany, Sara Sussman, Enectali Figueroa-Feliciano, Eli M Levenson-Falk, Taylor L. Patti

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究使用神经网络工作流程将超导量子比特目标哈密顿量参数映射到组件级布局参数,经训练和验证,该方法生成可用几何结构,误差低,速度快,有效扩展和补充传统电磁模拟,尤其适用于小数据集。

Comments v2: Clarified the methodology, validation, and runtime comparisons, and corrected minor presentation issues. Results and conclusions are unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31303 2026-08-03 cond-mat.mtrl-sci 版本更新 50%

A Practical Guide for Diagnosing Imaginary Phonon Modes in Metal--Organic Frameworks: The Case of MOF-5

诊断金属有机框架中虚声子模式的实用指南:以MOF-5为例

Julia Santana-Andreo, Caterina Cocchi

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出一种有限位移工作流,通过识别和排除数值噪声,可靠诊断MOF-5等金属有机框架中的虚声子模式,并利用模式映射或随机蒙特卡洛对称性破缺畸变定位低能局域极小值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05345 2026-08-03 physics.chem-ph 版本更新 50%

End-to-End Differentiable Learning of a Single Functional for DFT and Linear-Response TDDFT

端到端可微学习单个功能用于DFT和线性响应TDDFT

Xiaoyu Zhang

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出端到端可微学习方法,通过Kohn-Sham DFT和Adiabatic LR-TDDFT的目标优化单个深度学习能量功能,结合自洽场方程和Casida本征值问题进行梯度优化。

Comments 30 pages, 2 figures, 1 table, 78 equations

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01857 2026-08-03 cs.CE 版本更新 50%

An Embedded Mesh Approach for Isogeometric Boundary Layers in Contact Mechanics

一种用于接触力学中等参数边界层的嵌入网格方法

Eugenia Gabriela Loera Villeda, Ivo Steinbrecher, Alexander Popp

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种基于NURBS的边界层网格与结构化笛卡尔网格相结合的嵌入网格方法,用于高效处理接触力学问题中的界面离散化。

Comments Included some information after review: In Introduction: included a paragraph with more references. In Figure 13 (a) and (b): refined the stress scale to machine precision. In Subsection 4.5: A remark is included addressing issues with cut elements. Subsection 5.4: included a sensitivity analysis of the penalty paramenter to the Hertzian contact problem

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 13 篇

2607.29422 2026-08-03 cs.SE cs.AI cs.CR 新提交 86%

AgenticRepair: Multi-Faceted Program Context Engineering for Agentic Vulnerability Repair

AgenticRepair:面向智能体漏洞修复的多维度程序上下文工程

Michael Fu, Qiyue Mei, Patanamon Thongtanunam, Kla Tantithamthavorn

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 针对现有智能体漏洞修复方法缺乏多维度程序上下文工程的问题,提出AgenticRepair框架,协调三个LLM子智能体构建三类上下文,在SEC-Bench上取得73%的修复成功率,显著优于基线。

Comments Under Review at IEEE TSE

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28691 2026-08-03 cs.SE cs.AI 新提交 84%

Code Is the Body: Agent-Owned Software Bodies for Recursive Evolution and Descent

代码即主体:用于递归演化与传承的智能体自有软件主体

Roy Zhao, Zhenyu Zhao

专题命中 软件智能体 :agent(title,abstract);AI agent(abstract);分类 cs.AI、cs.SE

AI总结 该研究提出OurArk架构,以智能体自有软件主体为核心实现个人智能体的受控自演化与递归传承,在开源工具中实现并经测试验证,为个人智能体提供了可管控演化的具体基础。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28928 2026-08-03 cs.SE 新提交 79%

Automated Testing and Repair for Verified Compilers Generated by a Coding Agent

基于编码智能体生成的验证编译器的自动化测试与修复

Martin Rinard

专题命中 软件智能体 :agent(title,abstract);分类 cs.SE

AI总结 该研究针对编码智能体生成的验证编译器,提出了基于智能体的自动化测试与修复系统,经评估其在Axon编译器上无奖励黑客攻击问题,可有效开展测试与修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05131 2026-08-03 cs.CV cs.AI cs.RO 版本更新 79%

AREA3D: Active Reconstruction Agent with Unified Feed-Forward 3D Perception and Vision-Language Guidance

AREA3D: 带有统一前馈3D感知和视觉-语言引导的主动重建代理

Tianling Xu, Shengzhe Gan, Leslie Gu, Yuelei Li, Fangneng Zhan, Hanspeter Pfister

机构 * Southern University of Science and Technology(南方科技大学) Harvard University(哈佛大学) California Institute of Technology(加州理工学院) Massachusetts Institute of Technology(麻省理工学院)

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI

AI总结 AREA3D通过统一前馈3D感知与视觉-语言引导,实现高效主动3D重建,尤其在稀疏视角下提升重建精度。

Journal ref Tianling Xu, Shengzhe Gan, Leslie Gu, Yuelei Li, Fangneng Zhan, Hanspeter Pfister. The IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (The IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28871 2026-08-03 cs.SE cs.AI 新提交 73%

Validation Evidence in LLM Repair Agents: How Much of What Passes Actually Tests the Bug?

LLM修复智能体中的验证证据:通过的测试究竟在多大程度上能检验缺陷?

Xiaonan Xu, Wenjing Wu

专题命中 软件智能体 :agent(abstract);tool-use(abstract);分类 cs.AI、cs.SE

AI总结 本研究以BSG-VA方法分析LLM修复智能体的验证证据,发现近半数阳性测试无缺陷区分信息,缺陷对比反馈可减少证据不足的部署,其效果幅度仍需进一步验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29658 2026-08-03 cs.SE 新提交 70%

Reusing Past Repairs Through Hierarchical Trajectory Abstraction for Coding Agents

通过分层轨迹抽象复用编码智能体的过往修复工作

Yisen Xu, Jiayuan Zhou, Ruiqi Pan, Tse-Hsun Chen

专题命中 软件智能体 :agent(abstract,abstract_cn);分类 cs.SE

AI总结 本研究提出STAIR框架,通过分层轨迹抽象复用编码智能体过往修复经验,在SWE-bench Verified上显著提升修复智能体的Pass@1指标,且计划可跨智能体泛化。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28947 2026-08-03 cs.LG 新提交 70%

Overcoming the Weakest-Link Effect in LLM-Driven Program Optimization via Heterogeneous Edit Recombination

通过异构编辑重组克服大语言模型驱动的程序优化中的最弱链效应

Jingwen Fu, Zhen Liu, Yuhan Liu, He Zhang, Nanning Zheng

专题命中 软件智能体 :planning(abstract);agentic(abstract);分类 cs.LG

AI总结 本研究针对LLM程序优化的最弱链效应,提出HERO异构编辑重组优化器,可生成多样非重叠原子编辑并结合评估器分数组合改进,在多领域实现更高分数、更快收敛与更少token消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10046 2026-08-03 cs.SE 版本更新 70%

Automated Table Reproduction via Code Generation

Artisan: 自动化代理评估

Doehyun Baek, Michael Pradel

专题命中 软件智能体 :agent(abstract,abstract_cn);分类 cs.SE

AI总结 Artisan通过自动化LLM代理生成重现脚本,提升软件工程研究结果的可重复性,生成44/60个有效脚本并发现20个新错误。

Comments Accepted at ASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29637 2026-08-03 cs.CV cs.SE 新提交 57%

CodeShrink: Adaptive Visual Compression for Efficient Multimodal Code Understanding

CodeShrink:面向高效多模态代码理解的自适应视觉压缩

Wenxin Tang, Jingyu Xiao, Zhenyu Liu, Zipeng Xie, Junliang Liu, Wang Luo, Yuan Jiang, Yintong Huo, Michael Lyu

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 CodeShrink是含无空白渲染、自适应压缩配置、主导令牌选择的自适应视觉压缩框架,可减少代码理解的视觉令牌用量,在三类代码任务上优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28815 2026-08-03 cs.SE 新提交 57%

Preventing Premature Commitment in Coding Agents with an Evidence-Conditioned Execution Layer

通过证据条件执行层防止编码智能体的过早提交

Yisen Xu, Chenglin Li, Zehao Wang, Jinqiu Yang, Tse-Hsun Chen

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 ECLoop是介于编码智能体与仓库间的证据条件执行层,可防止过早提交,在SWE-bench Verified上提升Pass@1指标4.8-11.8个百分点,同时降低平均token消耗。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28775 2026-08-03 cs.SE 新提交 57%

Repository-Aware Metamorphic Relation Generation for Augmented Reality Applications using Large Language Models

基于大型语言模型的增强现实应用的仓库感知变形关系生成

Dibyendu Brinto Bose, Jiawei Qin, Chris Brown

专题命中 软件智能体 :agentic(abstract);分类 cs.SE

AI总结 本文提出一种结合仓库级上下文与推理编排的流水线,利用大型语言模型生成优化的变形关系,在142个移动AR仓库数据集上验证了该方法可构建可靠的领域相关测试预言,能有效检测代码变异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19338 2026-08-03 cs.AI 版本更新 57%

CodeRescue: Budget-Calibrated Recovery Routing for Coding Agents

CodeRescue:用于编码智能体的预算校准恢复路由

Qijia He, Jiayi Cheng, Chenqian Le, Rui Wang, Xunmei Liu, Yixian Chen, Jie Mei, Zhihao Wang, Xupeng Chen, Yuhuan Chen, Tao Wang

机构 * University of Washington(华盛顿大学) New York University(纽约大学) ByteDance(字节跳动) Amazon(亚马逊)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 研究编码智能体失败后的预算部署问题,核心方法是将其制定为异构动作上的恢复路由并训练监督路由器,添加CRC层实现预算变化下的成本控制,主要贡献是校准前沿在多个方面优于基线,节省恢复成本。

Comments Withdrawn at the request of ByteDance because the manuscript was submitted before completing the company's required internal review and approval process

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15755 2026-08-03 cs.SD cs.AI 版本更新 57%

AuEmoChat: Authentic Emotion Understanding and Rendering for Conversational Speech Synthesis

AuEmoChat:用于对话语音合成的真实情感理解与呈现

Zhenqi Jia, Yuan Zhao, Aruukhan, Rui Liu, Haizhou Li

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 针对对话语音合成中情感表达不真实及多模态令牌干扰问题,提出AuEmoChat框架,通过AuEmoCodec学习情感令牌空间、AuEmoToMe合并冗余令牌,集成到模型并结合情感流匹配渲染语音,实验证明其性能优于现有基线。

Comments Accepted by ACMMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏