arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 10469 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 10469 篇

2607.13078 2026-07-16 cs.CR cs.AI cs.LG 新提交 62%

Operational Evidence Gaps for LLMs in Fraud Detection and Trust-and-Safety Workflows

大语言模型在欺诈检测和信任与安全工作流程中的操作证据差距

Keyur Gabani

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 研究LLMs用于欺诈检测等信任与安全工作流程时的操作证据差距。通过对相关操作源编码调查发现证据失衡,欺诈任务部分大但缺乏关键证据。贡献了FORTE框架和部署证据清单,确定支持LLMs部署所需研究。

Comments 22 pages, 3 figures, 6 tables. Ancillary files include the evidence matrix, search note, and numeric claim check

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11981 2026-07-15 cs.CL cs.AI 新提交 62%

Evaluating Nonuniform Dependability Across Response Conditions: A Conditional Generalizability Framework Illustrated in Automated Essay Scoring

评估跨响应条件的非均匀可靠性:自动作文评分中的条件可推广性框架

Yi Gui

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 研究针对自动作文评分中跨响应条件非均匀可靠性评估问题,引入含三个部分的条件可推广性框架,通过比较分析与经验扫描、依熵分层等,以限时L2写作自动评分验证,提供了评估非均匀可靠性的可移植工作流程。

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.01898 2026-07-15 cs.LG cs.AI stat.ML 版本更新 62%

Propheticus: Machine Learning Framework for the Development of Predictive Models for Reliable and Secure Software

Propheticus:用于开发可靠安全软件预测模型的机器学习框架

João R. Campos, Marco Vieira, Ernesto Costa

机构 * DEI/CISUC, University of Coimbra,\ Portugal

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 针对软件可靠性与安全性需求,介绍Propheticus机器学习框架,抽象其复杂性以便用户使用,通过漏洞预测和在线故障预测两个案例研究,展示该框架能简化并加速机器学习工作流程。

Comments Accepted for publication in the 30th IEEE International Symposium on Software Reliability Engineering (ISSRE) 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11364 2026-07-14 cs.LG cs.AI cs.MM 新提交 62%

BackgroundMellow: A Multi-Modal Cohesive Framework for Narrative-Driven Rich Cinematic Soundscape Generation

BackgroundMellow:一种用于叙事驱动的丰富电影音效生成的多模态凝聚框架

Ajitesh Jamulkar, Aritra Hazra

机构 * Indian Institute of Technology Kharagpur(印度理工学院卡拉格布尔分校)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.LG

AI总结 多模态AI中为文本叙事生成电影音效困难,BackgroundMellow框架将其视为编排与信号处理问题,通过主 - 专家架构、Tango2模型、背景音乐检索器及NLP模块实现,经实验验证在时间同步等方面有效。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09094 2026-07-13 cs.CL cs.AI 新提交 62%

PRecG: Legal Precedent Retrieval with Graph Neural Networks and Rhetorical Role Segmentation

PRecG:基于图神经网络和修辞角色分割的法律先例检索

Devanshu Verma, Vasudha Bhatnagar, Vikas Kumar, Balaji Ganesan

机构 * University of Delhi(德里大学) IBM Research(IBM 研究院)

专题命中 工作流自动化 :planning(abstract);分类 cs.AI、cs.CL

AI总结 研究法律先例检索问题,提出PRecG管道,通过基于句子修辞角色分解文档、构建知识图、学习聚合实体上下文表示等步骤,分层学习法律判决对的表示来计算相似度,经实验验证其有效性。

Comments 23 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07974 2026-07-10 cs.CL cs.AI 新提交 62%

A Multi-cluster Boundary Learning Method for Out-of-Scope Intent Detection via MiniLM Embedding

一种基于MiniLM嵌入的多簇边界学习方法用于检测超出范围的意图

Yihong Xu, Mingyu Kang, Linyuan Lü

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 针对意图检测中超出范围意图检测的挑战,提出基于MiniLM嵌入的多簇边界学习方法,在单类分类工作流程中检测超出范围意图,实验表明该方法性能最优,所用MiniLM能更好适应相关要求。

Comments To submit

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07094 2026-07-09 cs.SE cs.AI 新提交 62%

MetaConfigurator: AI-Assisted RDF Authoring from JSON Data

MetaConfigurator:从JSON数据实现AI辅助的RDF创作

Felix Neubauer, Mahdi Jafarkhani, Kenichi Endo, Jürgen Pleiss, Benjamin Uekermann

机构 * Institute for Parallel and Distributed Systems, University of Stuttgart(并行与分布式系统研究所,斯图加特大学) Institute of Polymer Chemistry, University of Stuttgart(聚合化学研究所,斯图加特大学) Institute of Biochemistry, University of Stuttgart(生物化学研究所,斯图加特大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.SE

AI总结 提出一个集成AI辅助的RML映射、SPARQL查询和知识图谱可视化的Web界面,将JSON等结构化数据转换为RDF,并以MOF合成实验数据验证其有效性。

Comments Submitted as post-proceedings for the deRSE26 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05842 2026-07-08 cs.SE cs.AI cs.CR 新提交 62%

Beyond Refusal: A Same-Lineage Study of Aligned and Abliterated LLMs for Vulnerability Analysis

超越拒绝:用于漏洞分析的对齐和消除拒绝的大语言模型的同谱系研究

Mingchen Li, Meikang Qiu, Zifan Peng, Heng Fan, Song Fu, Junhua Ding, Yunhe Feng

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.SE

AI总结 研究大语言模型辅助软件安全中,同谱系模型的安全状态(对齐或消除拒绝)对软件安全工作流程防御效用的影响,通过比较不同模型在多方面的表现,发现评估应综合考量模型响应、响应正确性及输出在工程流程中的可操作性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02873 2026-07-07 cs.SE cs.AI cs.CR 新提交 62%

Determinants and Limits of LLM Security-Tool Orchestration: A Study with HexStrike-AI

大语言模型安全工具编排的决定因素与限制:基于HexStrike-AI的研究

Romain Gerard, Assmaa Zeghaider, Yan Guo

机构 * University of Science and Technology of China(中国科学技术大学) Suzhou Institute for Advanced Research(苏州研究院)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.SE

AI总结 以HexStrikeAI为测试平台,通过评估系统、诊断故障并改进,运行多类挑战,发现驱动客户端是固定模型的首要因素,整体解决率提升,剩余故障受推理或环境限制,还讨论了编排器评估及局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16337 2026-07-07 cs.AI cs.HC cs.LG 新提交 62%

Medical Heuristic Learning: An LLM-Driven Framework for Interpretable and Auditable Clinical Decision Rules

医学启发式学习:一个用于可解释和可审计临床决策规则的LLM驱动框架

Wei Xu, Ke Yang, Gang Luo, Keli Zheng, Lingyan Hu, Jing Wang, Kefeng Li

机构 * Centre for Artificial Intelligence Driven Drug Discovery, Macao Polytechnic University(人工智能驱动药物发现中心,澳门理工学院) Key Laboratory of Short-Range Radio Equipment Testing and Evaluation, Ministry of Industry and Information Technology Terahertz Science Application Center (TSAC), Beijing Institute of Technology(工业和信息化部短距离无线电设备测试与评估重点实验室,太赫兹科学应用中心(TSAC),北京理工大学) Department of Critical Care Medicine, Yantai Yuhuangding Hospital, Qingdao University(重症医学科,烟台友谊医院,青岛大学) Faculty of Education, The University of Hong Kong(教育学院,香港大学) College of Information Engineering, Dalian University(信息工程学院,大连大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出医学启发式学习(MHL),利用LLM驱动的工作流优化确定性可执行决策系统,生成可解释、可审计的Python决策规则,在医学数据集上达到与最先进方法相当的性能,并支持小样本和高度不平衡场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31311 2026-07-01 cs.HC cs.AI cs.LG 新提交 62%

From Idea to Prototype in an Afternoon: Scaffolded, AI-Assisted Rapid VA Prototyping

从想法到原型只需一个下午:脚手架式、AI辅助的快速可视化分析原型设计

Gennady Andrienko, Natalia Andrienko

机构 * Fraunhofer Institute IAIS(弗劳恩霍夫智能分析与信息系统研究所)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 本文通过案例展示,结合工作流语言和AI助手,将可视化分析原型的开发时间从数月缩短至一个下午,并总结了脚手架设计、知识注入和使用方式的三点经验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21958 2026-07-01 cs.SE cs.AI 62%

A systematic review of generative AI usage for IT project management

生成AI在IT项目管理中应用的系统综述

Ionut Anghel, Tudor Cioara

机构 * Computer Science Department, Technical University of Cluj-Napoca(克莱杰-纳波卡技术大学计算机科学系)

专题命中 工作流自动化 :AI agent(abstract);分类 cs.AI、cs.SE

AI总结 本文通过PRISMA方法综述生成AI在IT项目管理中的应用,总结技术、应用趋势、限制及工具整合,指出OpenAI的GPT主导但依赖提示工程,提出三个研究方向:过程组特定AI代理、基于项目角色的AI代理和混合协作网络。

Journal ref https://www.mdpi.com/2079-8954/14/6/722

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28002 2026-06-29 cs.CL cs.AI eess.AS 新提交 62%

Dialogue to Detection: A Multimodal Hybrid NLP Pipeline for Insurance Fraud Detection

对话到检测:用于保险欺诈检测的多模态混合 NLP 流水线

Muhammad Shakeel Akram, Amal Htait, Abdul Hamid Sadka, Emma Meisingseth, Karishma Jaitly

机构 * Aston University(阿斯顿大学) Domestic & General

专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出一种合成多模态框架,结合ASR、NER、LLM-RAG和说话人嵌入,通过规则风险评分检测保险欺诈中的叙述复用、结构不一致和跨案件语音重复。

Comments 10 pages, 8 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27973 2026-06-29 cs.CL cs.AI 新提交 62%

From Black-Box to Clinical Insight: A Multi-Stage Explainable Framework for Speech-Based Cognitive Impairment Detection

从黑盒到临床洞察:用于语音认知障碍检测的多阶段可解释框架

Yasaman Haghbin, Sina Rashidi, Ali Zolnour, Fatemeh Taherinezhad, Ali Fartoot, Hossein Azadmaleki, James M Noble, Maryam Dadkhah, Maryam Zolnoori

机构 * Independent Researcher(独立研究者) Columbia University(哥伦比亚大学) Chalmers University of Technology(查尔姆斯理工大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 提出多阶段可解释框架,结合SHAP、语言学特征和LLM推理,将黑盒Transformer预测转化为临床叙事,在NIA PREPARE基准上F1=72.11%,医生评估显示与患者认知特征高度一致,SUS评分82/100。

Comments Accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00827 2026-06-26 cs.LG cs.AI 版本更新 62%

Beyond Independent Manipulation: Individual Fairness-aware Strategic Classification with Peer Imitation

超越独立操纵:具有同伴模仿的个体公平感知策略分类

Xinpeng Lv, Chunyuan Zheng, Yunxin Mao, Renzhe Xu, Jinxuan Yang, Yuanlong Chen, Wangrong Huang, Shaowu Yang, Wenjing Yang, Xinwang Liu, Peng Cui, Haotian Wang

机构 * College of Computer Science and Technology, National University of Defense Technology(国防科技大学计算机科学与技术学院) School of Mathematical Sciences, Peking University(北京大学数学学院) Institute for Theoretical Computer Science, Shanghai University of Finance and Economics(上海财经大学理论计算机科学研究所) Information Technology Development, Aetos Capital Group, Sydney(悉尼Aetos资本集团信息技术部) Faculty of Computing, Harbin Institute of Technology(哈尔滨工业大学计算机学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.LG

AI总结 提出个体公平感知策略分类(IFSC)框架,通过建模基于个体公平的同伴驱动操纵(模仿邻近被接受同伴),并采用鲁棒学习过程处理同伴可观测性不确定性,以改善个体公平一致性并减轻模仿引起的扭曲。

Comments Accepted by SIGKDD2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25525 2026-06-25 cs.SE cs.AI 新提交 62%

The impact of artificial intelligence on enterprise software user roles

人工智能对企业软件用户角色的影响

Isabel Unger, Elizangela Valarini, Martin Schrepp, Nina Hollender, Gabriela Rocha, Erik Bertram

机构 * SAP SE(SAP股份有限公司) Fresenius Hochschule Heidelberg(海德堡弗里森纽斯大学)

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI、cs.SE

AI总结 本研究通过专家访谈和参与式研讨会,探讨AI如何改变SAP BTP平台上的用户角色,发现日常任务自动化、人机协作增强及对代理型AI系统的依赖增加,并指出现有角色框架需适应这些变化。

Comments 18 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24119 2026-06-24 cs.LG cs.CL 新提交 62%

When Top-1 Fails: Calibrating LoRA Monitors for Masked Diffusion LMs

当Top-1失败时:为掩蔽扩散LM校准LoRA监控器

Lucky Verma, Pratik Yadav

机构 * Independent Researcher(独立研究员) University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL、cs.LG

AI总结 针对离散扩散语言模型微调中top-1 argmax作为崩溃预警的零精度问题,提出使用最大LoRA梯度范数作为参数侧信号,在LLaDA族上实现0.68精度和0.79 F1分数,并建议每族DLM校准阈值。

Comments 14 pages, 3 figures. Code and result artifacts: https://github.com/lucky-verma/top1-fails-dlm-lora-monitors

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23757 2026-06-24 cs.LG cs.AI 新提交 62%

Synergizing Physically Constrained MCMC and Chemical-Informed Gaussian Processes for Reaction Network Discovery

协同物理约束MCMC与化学信息高斯过程进行反应网络发现

Runzhe Liu, Zihao Wang, Wenbo Yang, Shengyang Tao

机构 * State Key Laboratory of Fine Chemicals, Frontier Science Center for Smart Materials, Dalian University of Technology, Dalian, 116024, China(精细化学品国家重点实验室,智能材料前沿科学中心,大连理工大学,大连,116024,中国) Dalian Key Laboratory of Intelligent Chemistry, CR Belt and Road Joint Laboratory on Intelligent Chemistry and Advanced Materials of Liaoning Province, School of Chemistry, Dalian University of Technology, Dalian, 116024, China(大连智能化学重点实验室,辽宁省“一带一路”智能化学与先进材料联合实验室,化学学院,大连理工大学,大连,116024,中国) Academy of Interdisciplinary Studies, The Hong Kong University of Science and Technology, Clear Water Bay, Kowloon, Hong Kong(交叉学科研究院,香港理工大学,清水湾,九龙,香港)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出PC-MCMC-CIGP灰箱工作流,结合尖峰-板拓扑采样、硬守恒与热力学筛选及化学信息高斯过程残差模型,用于反应网络发现与实验设计,在H2+Br2基准和苯乙烯环氧化反应上验证了其区分机理和优化产量的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04840 2026-06-24 eess.AS cs.AI cs.CL 版本更新 62%

An Approach to Simultaneous Acquisition of Real-Time MRI Video, EEG, and Surface EMG for Articulatory, Brain, and Muscle Activity During Speech Production

一种用于言语产生过程中发音、大脑和肌肉活动的实时MRI视频、脑电图和表面肌电图同步采集方法

Jihwan Lee, Parsa Razmara, Kevin Huang, Sean Foley, Aditya Kommineni, Haley Hsu, Woojae Jeong, Prakash Kumar, Xuan Shi, Yoonjeong Lee, Tiantian Feng, Takfarinas Medani, Ye Tian, Sudarsana Reddy Kadiri, Krishna S. Nayak, Dani Byrd, Louis Goldstein, Richard M. Leahy, Shrikanth Narayanan

机构 * Signal Analysis and Interpretation Laboratory, University of Southern California(南加州大学信号分析与解释实验室) Ming Hsieh Dept. of Electrical and Computer Engineering, University of Southern California(南加州大学明希斯电气与计算机工程系) Dept. of Linguistics, University of Southern California(南加州大学语言学系)

专题命中 工作流自动化 :planning(abstract);分类 cs.AI、cs.CL

AI总结 本文首次实现了言语产生过程中实时MRI、EEG和表面EMG的同步采集,并提出了针对三模态设置的伪影抑制流程,为言语神经科学和脑机接口提供新视角。

Comments Accepted for Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20976 2026-06-23 cs.LG cs.AI 新提交 62%

Detecting Satellites in Radio-Frequency Data via Semi-Supervised Learning

通过半监督学习检测射频数据中的卫星

Cade W. Trotter, Maksim E. Eren, Justin C. Holmes, J. Brent Parham, David Ewing, Boian S. Alexandrov, Gian Luca Delzanno

机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室) MIT Lincoln Laboratory(麻省理工学院林肯实验室)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出结合非负矩阵分解与自动模型确定(NMFk)、专家引导聚类解释和分类器预测的半监督工作流,用于卫星监测中的射频检测与分类,减少对大量标注数据的依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17315 2026-06-19 cs.LG cs.AI 版本更新 62%

Flickering Multi-Armed Bandits

闪烁多臂老虎机

Sourav Chakraborty, Amit Kiran Rege, Claire Monteleoni, Lijun Chen

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) INRIA Paris(巴黎国家信息与自动化研究所)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.LG

AI总结 提出闪烁多臂老虎机模型,通过随机图约束动作可用性,设计两阶段懒惰随机游走算法实现次线性遗憾界,并证明信息论下界的最优性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17507 2026-06-17 cs.AI cs.SE 新提交 62%

LLM-as-Judge in Education: A Curriculum-Grounded Marking Pipeline

教育中的LLM作为评判者:基于课程标准的评分流水线

Xiwei Xu, Chen Wang, Jacky Jiang, Phil Yang, Qian Fu, Mohan Dhall, Wenjie Zhang, Liming Zhu

机构 * NSW Department of Education(新南威尔士州教育部) South Australian Department for Education(南澳大利亚州教育部) OC Selective exam preparation platform(OC精英考试备考平台) Studitory: HSC preparation platform(Studitory: HSC备考平台)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.SE

AI总结 提出一种基于课程标准的可配置LLM评判流水线,用于高利害考试评分,通过整合授权课程工件和评分指南,提高评分一致性、透明度和与官方实践的契合度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04243 2026-06-16 cs.LG cs.AI 版本更新 62%

Automated ultrasound doppler angle estimation using deep learning

基于深度学习的自动化超声多普勒角度估计

Nilesh Patil, Ajay Anand

机构 * Goergen Institute for Data Science(戈尔根数据科学研究所) University of Rochester Medical Center(罗切斯特大学医学中心) University of Rochester(罗切斯特大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出一种基于深度学习的自动化多普勒角度估计方法,使用2100张颈动脉超声图像及预训练模型,平均绝对误差3.9°-9.4°,最佳模型误差低于临床可接受阈值,可避免正常速度误判为狭窄。

Journal ref Annu Int Conf IEEE Eng Med Biol Soc. 2019 Jul;2019:28-31

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12616 2026-06-12 cs.AI cs.CL 新提交 62%

PersonaDrive: Human-Style Retrieval-Augmented VLA Agents for Closed-Loop Driving Simulation

PersonaDrive: 面向闭环驾驶模拟的人类风格检索增强VLA智能体

Mahmoud Srewa, Praneetsai Iddamsetty, Mohammad Abdullah Al Faruque, Salma Elmalaki

机构 * University of California, Irvine(加利福尼亚大学尔湾分校)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出PersonaDrive流水线,通过检索风格指令下的人类驾驶演示来调节视觉-语言-动作(VLA)驾驶智能体,实现闭环模拟中多样化的非自车智能体行为,无需针对每种风格重新训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11769 2026-06-11 cs.AI cs.LG 新提交 62%

When Do Data-Driven Systems Exhibit the Capability to Infer?

数据驱动系统何时展现出推理能力?

Maximilian Poretschkin, Tabea Naeven

机构 * Fraunhofer Institute for Intelligent Analysis and Information Systems (IAIS)(弗劳恩霍夫智能分析与信息系统研究所) University of Bonn(波恩大学) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔机器学习和人工智能研究所)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 针对欧盟AI法案中推理能力定义模糊的问题,基于统计学习理论提出分级框架,通过信用评分案例展示如何判断系统是否具备推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10713 2026-06-10 eess.IV cs.AI cs.CV cs.LG 新提交 62%

++nnU-Net: Scaling nnU-Net with Prefix-Based Data Augmentation

++nnU-Net: 基于前缀数据增强的nnU-Net扩展

Ana Sofia Santos, André Ferreira, Gijs Luijten, Naida Solak, Lisle Faray de Paiva, Behrus Hinrichs-Puladi, Jens Kleesiek, Jan Egger, Victor Alves

机构 * Center Algoritmi / LASI, University of Minho, Braga, Portugal(阿尔戈里米中心/拉斯伊大学,明霍大学,布拉加,葡萄牙) Institute for Artificial Intelligence in Medicine, University Medicine Essen, Essen, Germany(医学人工智能研究所,埃森医学院,埃森,德国) Institute of Medical Informatics / Dept. of Oral and Maxillofacial Surgery, University Hospital RWTH Aachen, Germany(医学信息学研究所/口腔和颅面外科部,亚琛大学医院,德国) Faculty of Computer Science, University of Duisburg-Essen, Essen, Germany(计算机科学学院,杜伊斯堡-埃森大学,埃森,德国)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出++nnU-Net,通过图像配准进行数据增强,在预处理和训练前生成变形图像,在5个2D数据集上提升Dice系数最高约22%。

Comments 7 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09949 2026-06-10 cs.LG cs.AI 新提交 62%

Learning Where to Simulate: Generative Active Sampling for Online PDE Surrogate Training

学习何处模拟:在线PDE代理训练的生成式主动采样

Pierre Cesar, Sofya Dymchenko, Abhishek Purandare, Bruno Raffin

机构 * Univ. Grenoble Alpes(格勒诺布尔阿尔卑斯大学) Inria(法国国家科学研究中心) CNRS(法国国家科学研究中心) Grenoble INP(格勒诺布尔研究所) LIG(实验室)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出在线生成式主动采样(OGAS),通过扩散模型学习配置参数与代理性能的关系,主动采样高难度区域,显著降低尾部分布误差,提升代理最坏情况可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09899 2026-06-10 cs.LG cs.AI 新提交 62%

When Attribution Patching Lies: Diagnosis and a Second-Order Correction

当归因补丁说谎时:诊断与二阶修正

Luyang Zhang, Jialu Wang

机构 * Carnegie Mellon University(卡内基梅隆大学) University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 研究归因补丁(梯度一阶近似)在机制可解释性中的不可靠性,发现主要误差源于下游网络的非线性,并提出可靠性评分、误差界和HVP二阶修正方法。

Comments 30 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09846 2026-06-10 cs.HC cs.AI cs.CL 新提交 62%

CANVAS: Captioning Art with Narrative Visual-Audio AI Systems

CANVAS: 用叙事视觉音频AI系统为艺术配文

Vignesh Nagarajan

机构 * BASIS Phoenix High School(BASIS凤凰高中)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 提出一种自动化工作流,利用大语言模型和文本转语音服务生成多感官艺术描述和同步音频解说,在20秒内以低于0.05美元的成本生成文本加音频输出,显著提高词汇多样性和叙事细节。

Comments 22 pages, 16 figures, 3 tables, 21 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02221 2026-06-10 cs.LG cs.AI 版本更新 62%

MedFeat: Model-Aware and Explainability-Driven Feature Engineering with LLMs for Clinical Tabular Prediction

MedFeat: 基于模型感知与可解释性驱动的LLM特征工程用于临床表格预测

Zizheng Zhang, Yiming Li, Justin Xu, Jinyu Wang, Rui Wang, Lei Song, Jiang Bian, David W Eyre, Jingjing Fu

机构 * Microsoft Research(微软研究院) University of Oxford(牛津大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出MedFeat框架,利用模型感知和特征重要性信号迭代引导LLM生成针对性特征,在临床表格预测中平均提升超10%。

详情

展开后加载摘要…

URL PDF HTML 收藏