arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

2026-07-31 至 2026-07-31 共收录 11 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 诊断辅助 11 篇

2607.28148 2026-07-31 cs.CV cs.LG 新提交 84%

What Makes Deep Learning Work for Traditional Chinese Medicine Tongue Diagnosis? A Comprehensive Ablation Study

深度学习为何能用于中医舌诊?一项全面的消融研究

Longxia Gao, Linan Wang, Yuhe Han, Junze Geng, Meng Zhang, Hanqing Zhao

机构 * College of Traditional Chinese Medicine, Hebei University(河北大学中医学院)

专题命中 诊断辅助 :diagnosis(title,abstract);medical image(abstract);分类 cs.CV、cs.LG

AI总结 该研究通过对中医舌诊数据集开展消融实验,明确了深度学习模型的关键设计原则,为相关多标签医学图像分类任务提供了可推广的依据。

Comments 30 pages, 8 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27443 2026-07-31 cs.AI 新提交 78%

Leveraging Trajectory Graphs for Pre-Execution Error Diagnosis in Agentic LLM Systems

利用轨迹图实现智能体大语言模型系统的预执行错误诊断

Xu Zheng, Zhuomin Chen, Chaohao Lin, Hua Wei, Haifeng Chen, Wei Cheng, Dongsheng Luo

机构 * Florida International University(佛罗里达国际大学) Arizona State University(亚利桑那州立大学) NEC Laboratories America(美国 NEC 实验室) Singapore Management University(新加坡管理大学)

专题命中 诊断辅助 :diagnosis(title,abstract)

AI总结 该研究提出Trajectory Graph Copilot框架,以Graph Debugger为核心,通过预执行错误诊断提升LLM智能体完成长周期任务的能力,在多基准测试中平均提升14.69%通过率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27360 2026-07-31 cs.AI 新提交 78%

SkillMentor: LLM Agent Self-Evolution via Learning Blind-Spot Diagnosis

SkillMentor:基于盲点诊断的大语言模型智能体自我进化

Xiaoyi Bao, Yuanzhen Xie, Yunzhi Tan, Jinghang Gu, Zhongqing Wang, Chu-Ren Huang, Bo Hu, Zang Li

机构 * The Hong Kong Polytechnic University(香港理工大学) Platform and Content Group, Tencent(腾讯平台与内容事业群) Soochow University(苏州大学)

专题命中 诊断辅助 :diagnosis(title,abstract)

AI总结 本文提出SkillMentor,将盲点诊断作为独立于执行的可学习智能体能力,通过强化学习训练导师策略,在AppWorld和BFCLv3上使执行器性能平均提升44.2%,实现无需更新执行器的智能体自我进化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27384 2026-07-31 cs.CL cs.AI 新提交 71%

Same Facts, Different Diagnosis: Measuring and Mitigating Narrative Anchoring in Clinical Language Models

相同事实,不同诊断:临床语言模型中叙事锚定的测量与缓解

Prabhjot Singh, Pritam Deka, Vijay Chennareddy

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Queen’s University Belfast(贝尔法斯特女王大学) Middlesex University London(伦敦密德萨斯大学)

专题命中 诊断辅助 :diagnosis(title)

AI总结 本研究针对临床语言模型的叙事锚定偏差,构建含1000个USMLE案例的基准,提出NarrativeShield三智能体流水线,可大幅降低叙事锚定差距并减少不稳定决策,同时发布数据集供相关研究使用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27386 2026-07-31 cs.AI cs.LG 新提交 57%

Beyond the Bidirectional Promise: Re-evaluating the Robustness of Diffusion Language Models

超越双向承诺:重新评估扩散语言模型的鲁棒性

Saurabh Yadav, Badri Narayana Patro, Vijay Srinivas Agneeswaran

机构 * Microsoft(微软公司)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 该研究评估了扩散语言模型的鲁棒性,发现其虽能抵御部分对抗攻击但易受自然噪声影响,存在过度自信问题,脆弱性源于解码器路由故障,需将鲁棒性整合入迭代解码循环。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27888 2026-07-31 cs.AI 新提交 50%

Not All Tokens Deserve Equal Credit: Counterfactual Sensitivity Credit Reallocation for Long-CoT Reasoning

并非所有 token 都应获得同等权重:面向长思维链(Long-CoT)推理的反事实敏感性权重重分配

Qiangqiang He, Zhongheng Wu, ZiJian Wang

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(南京大学现代软件技术国家重点实验室) Institute of Wireless Communications Technology, Shanghai Jiao Tong University(上海交通大学无线通信技术研究所)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 针对长思维链推理中均匀分配 token 权重的缺陷,提出反事实敏感性权重重分配方法,在数学推理基准上优于 GRPO,验证了特权诱导方向不可靠的诊断。

Comments 20 pages, 6 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27798 2026-07-31 cs.AI 新提交 50%

MemeBench: What LVLMs Miss When Interpreting Culture-Dependent Memes

MemeBench:大型视觉语言模型在解读依赖文化的梗图时所缺失的内容

Weihang Wang, Kainan Tu, Jielei Zhang, Run Yang, Boheng Sheng, Yuchen He, Yu Xie, Pengyu Chen, Peiyi Li, Huyang Sun, Longwen Gao, Zhouhui Lian

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究针对LVLMs解读文化类梗图的知识缺口问题,推出诊断基准MemeBench及实体引导检索基线KAR,验证了检索手段可提升梗图解读的VIKR成功率。

Comments 17 pages, 5 figures, and 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27586 2026-07-31 cs.CY cs.AI 新提交 50%

Is Solving Better Than Evaluating GenAI Solutions?

解决生成式AI(GenAI)方案比评估更好吗?

Ethan Dickey, Marios Mertzanidis, Alexandros Psomas

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 通过220名大三算法课学生的随机A/B交叉研究发现,评估GenAI方案与传统解题的整体成绩无显著差异,仅作业成绩局部更高,需刻意支架式教学才能获得学习收益。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28161 2026-07-31 stat.ME math.ST stat.ML stat.TH 新提交 50%

A Mathematical Framework for Topological Causal Data Analysis

拓扑因果数据分析的数学框架

Hugo Gobato Souto, Ioannis Diamantis

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 该研究提出拓扑因果数据分析(TCDA)框架,区分结果级与分布级TCDA,构建对应识别与表示方法,明确观测拓扑在因果发现中的作用,为结构化对象的因果分析提供数学基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27414 2026-07-31 astro-ph.IM astro-ph.EP astro-ph.GA astro-ph.SR 新提交 50%

PhoPS: An automated photometric pipeline for survey-era astronomy

PhoPS:面向勘测时代天文学的自动测光流水线

Orhan Erece, Yucel Kilic

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 针对现代天文勘测的海量数据需求,研究人员开发了开源自动测光天体测量流水线 PhoPS,通过动态 Gaia DR3 索引与 RANSAC 零点模型提升精度,适用于小行星光变等天文研究。

Comments 11 pages, 9 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20540 2026-07-31 econ.TH 版本更新 50%

Diagnostic Feedback under Hidden Task Difficulty

隐藏任务难度下的诊断反馈

Mark Izgarshev, Georgy Lukyanov

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 该研究针对隐藏任务难度的场景,提出均衡精炼机制,可在特定条件下实现对困难任务的诊断,证明隐藏难度能生成智能体相关信息,且该机制适用于连续努力与不完美诊断的情况。

详情

展开后加载摘要…

URL PDF HTML 收藏