arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

共收录 141 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 诊断辅助 141 篇

2607.20800 2026-08-13 cs.CR 版本更新 50%

Classical Acceptance Is Not Hybrid Authentication: Validation Policy and Lifecycle Management of Hybrid X.509 Certificates in Deployed Open-Source Stacks

经典接受并非混合认证:在后量子迁移中测量X.509验证器语义

Taesung Kim, Boheung Chung, Keonwoo Kim, Yousung Kang

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究后量子迁移中X.509混合证书验证问题,通过对多种验证堆栈、模式和证书方案测量,发现经典路径验证常忽略后量子证据,存在互操作性和绑定问题,贡献了验证器模型和参考合同并分析标准未要求的原因。

Comments 15 pages, 1 figure, 7 tables. Substantially revised manuscript with a management-focused framing, expanded lifecycle analysis, a policy-parametric validation contract, and updated reproducibility materials. Submitted to IEEE Transactions on Network and Service Management

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01597 2026-08-12 eess.AS cs.SD 版本更新 50%

Toward Fair Speech Technologies: A Comprehensive Survey of Bias and Fairness in Speech AI

面向公平的语音技术:语音AI中的偏差与公平性综合综述

Yi-Cheng Lin, Yun-Shao Tsai, Kuan-Yu Chen, Hsiao-Ying Huang, Huang-Cheng Chou, Shrikanth Narayanan, Yu Tsao, Jian-Jiun Ding, Hung-yi Lee

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本综述整合400余项相关研究,构建统一框架,针对语音模态提出7种公平定义,梳理偏差来源并系统化缓解策略,为语音AI的公平性研究提供了全面指引。

Comments 73 pages, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17188 2026-08-12 cs.AI 版本更新 50%

UPAIR: Diagnosing Reasoning States via Uncertainty-Progress Alignment for Selective Intervention

你的模型是在思考还是停滞不前?PUMA:通过相位动量对齐诊断推理病理学

Cheng Yan, Zhijun Fan, Guangyang Ye, Fan Xu, Xiang Xia, Yawei Wang, Wuyang Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究大型推理模型测试时的“过度思考”问题,提出相位动量对齐假设并构建认知能量模型,引入PUMA框架,通过分层诊断架构区分主动探索与被动停滞,在多基准实验中优于现有基线,实现更好的准确性-效率权衡和跨域泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28126 2026-08-11 cs.AI 版本更新 50%

ConMem: Contribution-Aware Memory for Long-Horizon Manufacturing Inspection Logs

ConMem:面向长周期制造检查日志的贡献感知记忆

Bingchen Liu, Yuanyuan Fang, Lei Liu, Guangyuan Dong, Xing Fu, Yuanyuan Gao, Shuyue Wei, Xin Li, Xiangtian Meng

机构 * Shandong University(山东大学) Boston University(波士顿大学) North China Electric Power University(华北电力大学) National University of Singapore(新加坡国立大学) Joint SDU-NTU Centre for Artificial Intelligence Research (C-FAIR), Shandong University(山东大学-南洋理工大学人工智能联合研究中心(C-FAIR)) Rizhao Steel Holding Group Co., Ltd.(日照钢铁控股集团有限公司)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 该研究针对长周期制造检查日志的早期风险筛查需求,提出ConMem贡献感知记忆框架,通过Shapley风格评估保留高价值证据,在真实数据集上实现76.0% QA准确率,大幅减少输入token数与响应时间,可有效保留弱早期信号并提供预警。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20497 2026-08-11 cs.AI 版本更新 50%

From Errors to Rules: Iterative Prompt Optimization for Text Classification

从错误到规则:文本分类的迭代提示优化

Yueying Cui, Renhao Xue, Yi Zhang, Mukul Prasad

机构 * Amazon Web Services(亚马逊网络服务公司)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究文本分类的提示优化方法,提出错误引导优化(ERGO)方法,通过诊断-规定-重写反馈循环迭代训练集。该方法在特定任务上准确率最高,能生成可解释规则,还提供了任务特征与最优范式选择的互补框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22966 2026-08-11 cs.CL 版本更新 50%

Prompt engineering does not universally improve Large Language Model performance across clinical decision-making tasks

提示工程并不能普遍提升大型语言模型在临床决策任务中的性能

Mengdi Chai, Ali R. Zomorrodi

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本研究发现提示工程对LLMs在临床决策任务中的性能提升具有高度依赖模型和任务的特性,强调了定制化策略的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09636 2026-08-11 cs.CL 版本更新 50%

MiraMind: Benchmarking Reliable Mental Health Reasoning beyond Answer Accuracy

MentraSuite:面向心理健康推理与评估的训练后大语言模型

Mengxi Xiao, Kailai Yang, Pengde Zhao, Enze Zhang, Ziyan Kuang, Zhiwei Liu, Weiguang Han, Shu Liao, Lianting Huang, Guojun Xiong, Victor Gutierrez Basulto, Jinpeng Hu, Min Peng, Qianqian Xie, Sophia Ananiadou

机构 * School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) Center for Language and Information Research, Wuhan University(武汉大学语言信息研究中心) The University of Manchester(曼彻斯特大学) School of Computer Science, Wuhan University(武汉大学计算机科学学院) Mount Holyoke College(马歇尔学院) Hefei University of Technology(合肥工业大学)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 MentraSuite通过训练后模型Mindora,提升心理健康推理的可靠性与一致性,适用于复杂的心理健康评估与诊断场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01347 2026-08-07 cs.CL 版本更新 50%

Same Task, Different Work: Prompt-Induced Waste in Coding Agents

提示词诱导的大推理模型浪费:一项预注册的双框架编码智能体基准测试

Sarel Weinberger, Amir Hozez

机构 * PointFive

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 该研究通过预注册基准测试发现,提示词措辞和智能体框架会大幅影响大推理编码智能体的成本,部分提示指令可成倍增加推理成本却不提升任务成功率,框架选择的成本差异更显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01788 2026-08-04 cs.SE 版本更新 50%

KRCA: An Efficient Root Cause Analysis System in Hyper-scale Microservice Systems via Agentic AI

KRCA:一种基于智能体AI的超大规模微服务系统高效根因分析系统

Jiamin Jiang, Jingfei Feng, Yu Luo, Qingliang Zhang, Yongqian Sun, Wenwei Gu, Shenglin Zhang, Tianyu Cui, Yao Wu, Jielong Huang, Nan Qi, Dan Pei

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 提出KRCA系统,通过多阶段流水线(API级钻取、骨架因果图、记忆增强多智能体框架)实现超大规模微服务的高效根因定位与故障分类,AC@1达0.88和0.79,诊断时间减少77.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02292 2026-08-04 stat.ME stat.AP 版本更新 50%

A neighbour selection approach for identifying differential networks in conditional functional graphical models

一种用于识别条件功能图模型中差异网络的邻居选择方法

Alessia Mapelli, Laura Carini, Francesca Ieva, Sara Sommariva

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本文提出了一种基于功能-功能回归的邻居选择方法,用于识别条件功能图模型中的差异网络,通过协变量调节连接模式并提高估计精度和计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19345 2026-08-03 cs.CL cs.AI 版本更新 50%

Copy Less, Ground More: Overcoming Repetitive Copying in Long-Context Reasoning via Evidence-Aware Reinforcement Learning

少复制,多扎根:通过证据感知强化学习克服长上下文推理中的重复复制

Lizhe Fang, Weizhou Shen, Tianyi Tang, Yisen Wang

机构 * Peking University(北京大学) Alibaba Group(阿里巴巴集团)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究长上下文推理中语言模型的重复复制问题,提出GEAR奖励塑造方法,通过区分关键证据和干扰上下文来增强奖励信号,经实验验证该方法能提升模型性能,减少重复复制,凸显准确扎根证据对长上下文推理的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29888 2026-08-03 cs.HC cs.AI 版本更新 50%

Generative AI in Action: Field Experimental Evidence from Alibaba's Customer Service Operations

生成AI在行动:来自阿里巴巴客户服务中心的实地实验证据

Xiao Ni, Yiwei Wang, Tianjun Feng, Lauren Xiaoyan Lu, Yitong Wang, Congyi Zhou

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学) Dartmouth College(达特茅斯学院) Alibaba Group Inc.(阿里巴巴集团)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本研究通过大规模实地实验评估生成AI助手对电商售后客服人员绩效的影响,发现AI显著提升服务速度和服务质量,但对顶级员工产生负面影响,提示需定制化部署策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20540 2026-07-31 econ.TH 版本更新 50%

Diagnostic Feedback under Hidden Task Difficulty

隐藏任务难度下的诊断反馈

Mark Izgarshev, Georgy Lukyanov

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 该研究针对隐藏任务难度的场景,提出均衡精炼机制,可在特定条件下实现对困难任务的诊断,证明隐藏难度能生成智能体相关信息,且该机制适用于连续努力与不完美诊断的情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23321 2026-07-30 cs.IR 版本更新 50%

MMEB-V3: Measuring the Performance Gaps of Omni-Modality Embedding Models

MMEB-V3: 多模态嵌入模型性能差距的测量

Haohang Huang, Xuan Lu, Mingyi Su, Xuan Zhang, Ziyan Jiang, Ping Nie, Kai Zou, Tomas Pfister, Wenhu Chen, Wei Zhang, Xiaoyu Shen, Rui Meng

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本文提出MMEB-V3基准,评估文本、图像、视频、音频及基于代理的多模态嵌入,发现现有模型在跨模态检索中存在显著偏差和不足。

Comments Accepted at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02787 2026-07-29 stat.ME 版本更新 50%

When Does Trial-Real-World Data Fusion Improve Precision? Model Auditing and Selection-Aware Inference for Adaptive-TMLE

现实世界数据何时能使随机试验更高效,以及如何知晓?一份成绩单、一张效率图以及针对自适应TMLE的选择感知推断

M. Ehsan Karim

专题命中 诊断辅助 :biomedical(abstract)

AI总结 以自适应靶向最大似然估计为例,开发三个工具。包括使估计器偏差模型可审计的成绩单、对比仅试验估计器的融合利弊图、对增益进行选择感知推断,用于评估现实世界数据与试验数据结合的效果。

Comments 42 pages, 4 figures, 13 tables; 48-page supplementary Web Appendix included as an ancillary file. Reproducible code: https://github.com/ehsanx/atmle-efficiency

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18902 2026-07-29 cs.CL 版本更新 50%

SAGE: Stochastic Prompt Optimization via Agent-Guided Exploration

SAGE: 基于智能体引导探索的随机提示优化

Ziyi Zhu, Luka Smyth, Saki Shinoda, Jinghong Chen

机构 * Slingshot AI Department of Engineering, University of Cambridge(剑桥大学工程系)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 提出随机提示优化框架SPO,其中SAGE方法通过多智能体诊断代码执行实现黑盒搜索,在多个基准测试中表现依赖于错误类型,并在心理健康聊天机器人中通过连续优化显著提升次日留存率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27784 2026-07-28 cs.AI 版本更新 50%

WIRE: Profiling Witnessed Within-Policy Instruction Collisions in LLM Agents

诊断LLM代理中实时策略内指令冲突的见证解析轮廓

Lu Yan, Xuan Chen, Xiangyu Zhang

机构 * Purdue University(普渡大学)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 提出WIRE管道,通过提取规则、编码为PyRule子句、检测冲突并生成见证实例,诊断LLM代理单一提示策略内规则对之间的冲突,发现64.6%的见证实例至少违反一条源规则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06616 2026-07-27 cs.CL 版本更新 50%

Interpretable Depression Detection from Social Media Text Using LLM-Derived Embeddings

使用基于大语言模型的嵌入从社交媒体文本中进行可解释的抑郁症检测

Samuel Kim, Oghenemaro Imieye, Yunting Yin

机构 * Earlham College(埃尔哈姆学院)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究利用大语言模型和传统机器学习分类器,针对社交媒体文本进行三项心理健康预测任务。通过多数据集五折交叉验证实验发现,零样本LLMs在二元抑郁分类表现好,细粒度严重程度预测差;基于LLM摘要嵌入的监督模型性能更优,为构建有效可解释评估系统提供方向。

Comments This version of the contribution has been accepted for publication at ICAI 2026, after peer review but is not the Version of Record and does not reflect post-acceptance improvements, or any corrections

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17719 2026-07-22 cs.AI cs.MA 版本更新 50%

SR-Agent: An Experience-Driven Agentic Framework for Post-Ranking Strategy Refinement in E-Commerce Recommendation

SR-Agent:一种用于电子商务推荐中排序后策略优化的经验驱动智能框架

Hanchen Yang, Kaiwen Yang, Junpeng Zhuang, Yang He, Keting Cen, Bochao Liu, Zhongbo Sun, An Liu, Zhongteng Han, Chenyi Lei

机构 * Kuaishou Technology(快手科技)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 电商推荐系统中,后排序策略因环境变化需优化,以往方式存在问题。本文提出SR-Agent框架,统一用户模拟、分析和策略优化组件,经快手平台测试,能提升订单量、浏览深度和点击类别多样性,还缩短优化周期、降低成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09637 2026-07-21 cs.PL 版本更新 50%

Network Analysis with Parametric NetKAT

使用参数化NetKAT进行网络分析

Han Xu, Zachary Kincaid, David Walker

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究网络诊断和推理任务中的枚举问题,核心方法是使用参数化NetKAT语言,贡献为介绍其设计语义、编译方法、算法及正确性证明,并评估了在工业基准测试中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05642 2026-07-21 quant-ph cs.NI 版本更新 50%

Towards Quantum Network Performance Metrics: Challenges and Demonstration

迈向量子网络性能指标:挑战与演示

Mohamed Shaban, Mariam Kiran, Muhammad Ismail

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 针对量子网络实际部署中标准化性能监测的需求,提出含多种性能指标的结构化监测框架,实现实时观测等功能,通过原型系统展示可行性,讨论监测挑战,为量子网络监测及相关发展奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26985 2026-07-21 cs.GR 版本更新 50%

Vis4GS: A Visual Analytic Tool for 3D Gaussian Splatting Reconstruction

Vis4GS: 3D高斯泼溅重建的可视分析工具

Kai-Yuan Lin, Aryabima Mandala Putra, Jui-Chi Lee, Shih-Hsuan Hung

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 针对3DGS重建中高斯属性对伪影的影响难以解释的问题,提出Vis4GS多视图可视分析工具,通过链接伪影与高斯属性、视图覆盖、训练进度和谱系,支持结构化诊断重建失败原因。

Comments Accepted to IEEE VIS 2026 Short Papers

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15841 2026-07-21 cs.AI 版本更新 50%

Heteroskedastic Signals in Budgeted LLM Verification: Structural Heterogeneity Limits Optimization Gains

预算受限LLM验证中的异方差信号:结构异质性限制了优化收益

Jinlong Yang

机构 * Northwestern Polytechnical University(西北工业大学)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本文发现LLM不确定性信号在预算受限验证中存在异方差性,导致全局分配扭曲;通过分层阈值干预(CST)在强异质性设置下提升命中率达17个百分点,揭示结构异质性是主要瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00997 2026-07-21 physics.optics physics.bio-ph physics.med-ph 版本更新 50%

AI-Assisted Hyperspectral Interferometry and Single-Cell Dispersion Imaging

人工智能辅助的高光谱干涉测量与单细胞色散成像

Kamyar Behrouzi, Tanveer Ahmed Siddique, Megan Teng, Walid Redjem, Liwei Lin, Boubacar Kante

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究提出宽带且人工智能增强的GPCPI干涉测量方法,通过深度神经自编码器检测相位异常,提高相位测量准确性与稳定性。用于等离子体超表面相位传感和高光谱单细胞色散成像,可在单细胞水平进行细胞分类和疾病诊断,为多领域提供可靠成像解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04593 2026-07-20 cs.IR cs.AI cs.CL 版本更新 50%

Ruling Out to Rule In: Contrastive Hypothesis Retrieval for Medical Question Answering

排除谬误以确认正确:面向医疗问答的对比假设检索

Byeolhee Kim, Min-Kyung Kim, Young-Hak Kim, Tae-Joon Jeon

机构 * Asan Medical Center(峨山医疗中心) Yonsei University(延世大学) University of Ulsan College of Medicine(蔚山大学医学院)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本文提出对比假设检索框架CHR,通过生成正确和错误假设来提升医疗问答系统检索效果,实验显示在多个基准测试中优于现有方法,有效减少硬负样本污染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17612 2026-07-17 cs.PL cs.AI 版本更新 50%

Provable Coordination for LLM Agents via Message Sequence Charts

通过消息序列图实现LLM代理的可证明协调

Benedikt Bollig, Matthias Függer, Thomas Nowak

机构 * Université Paris-Saclay, CNRS, ENS Paris-Saclay, LMF, Gif-sur-Yvette, France(巴黎萨克雷大学、法国国家科学研究中心、巴黎萨克雷高等师范学院、LMF、法国吉夫-sur-耶vette) Institut Universitaire de France, Paris, France(法国国家科学院、巴黎,法国)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本文提出基于消息序列图的领域特定语言,用于规范LLM代理协调,解决死锁和消息类型不匹配等问题,通过语法引导投影生成无死锁的局部代理程序,并展示如何在LLM非确定性基础上建立协调属性。

Comments 42 pages; accepted at ISoLA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24239 2026-07-16 cond-mat.mes-hall cond-mat.dis-nn cond-mat.mtrl-sci 版本更新 50%

Identifying geometric third-order nonlinear transport in disordered materials

识别无序材料中的几何三阶非线性输运

Zhen-Hao Gong, Zhi-Hao Wei, Hai-Zhou Lu, X. C. Xie

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究无序材料中三阶非线性输运机制,建立机制分辨和对称性引导框架,发现20种机制,提出结合对称性诊断与标度律的数据分析方案,可定量区分机制,应用该方案识别多种材料的几何机制,理论可推广到任意阶。

Comments 10 pages, 3 figures, 2 table

Journal ref Phys. Rev. X 16, 031012 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20318 2026-07-15 cs.DB 版本更新 50%

AgenticDB: Self-Evolving Reconfiguration Framework for Database Workloads

AgenticDB: 面向数据库工作负载的代理式性能重配置

Xinyue Yang, Chaozheng Wang, Chen Zheng, Heng Zhang, Yanjun Wu

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 提出AgenticDB框架,通过运行时交互实现数据库系统级和操作系统级重配置,诊断瓶颈并积累经验,在MySQL和PostgreSQL上平均性能提升118.1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12612 2026-07-10 cs.IR cs.AI 版本更新 50%

Self-EvolveRec: Self-Evolving Recommender Systems with LLM-based Directional Feedback

Self-EvolveRec:基于大语言模型定向反馈的自进化推荐系统

Sein Kim, Sangwu Park, Hongseok Kang, Wonjoong Kim, Jimin Seo, Yeonjun In, Kanghoon Yoon, Hyunsik Jeon, Chanyoung Park

机构 * Microsoft(微软)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究针对传统推荐系统设计方法局限,提出Self-EvolveRec框架,集成用户模拟器与模型诊断工具建立定向反馈循环,并引入协同进化策略。实验证明该框架在推荐性能和用户满意度上显著优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25155 2026-07-08 physics.soc-ph 版本更新 50%

Bidirectional yet asymmetric causality between urban systems and traffic dynamics in 30 cities worldwide

全球30个城市中城市系统与交通动态之间的双向但不对称因果关系

Yatao Zhang, Ye Hong, Song Gao, Martin Raubal

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究全球30个城市中城市系统与交通动态的关系,提出时空因果框架,结合时空加权回归与收敛交叉映射,揭示双向不对称因果关系及三种因果原型,为可持续城市和交通规划提供策略依据。

Comments Published in Nature Communications

Journal ref Nature Communications 17, 4671 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏