arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

2026-07-31 至 2026-07-31 共收录 36 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 医学影像 15 篇

2607.28487 2026-07-31 cs.CV 新提交 91%

AuricularWorld: Hierarchical Action-Guided World Modeling for Fine-Grained Auricular Structure Segmentation from CT Scans

AuricularWorld:用于CT扫描中耳部结构细粒度分割的分层动作引导世界建模

Jingwen Yang, Senmao Wang, Luoyao Kang, Runmeng Cui, Keying Zhang, Yunjia Bao, Haifan Gong, Lin Lin, Haiyue Jiang

机构 * Plastic Surgery Hospital, Chinese Academy of Medical Sciences & Peking Union Medical College(中国医学科学院北京协和医学院整形外科医院) The Chinese University of Hong Kong(香港中文大学) The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳))

专题命中 医学影像 :CT(title,title_cn);medical image(abstract);分类 cs.CV

AI总结 该研究针对CT耳部细粒度分割难题,提出分层动作引导的AuricularWorld世界建模框架,通过迭代解剖学推理提升分割精度,使HD95降低超43%,验证了潜在世界模型推理的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28327 2026-07-31 cs.CV 新提交 90%

Same Branches, Different Trees: A Bifurcation Connectedness Metric for Coronary Artery Segmentation and FFR-CT Decision Agreement

相同分支,不同树:用于冠状动脉分割及FFR-CT决策一致性的分叉连通性度量

Maame Owusu-Ansah, Kelvin Lee, Dr Vinod Venugopal, Muhammad Moazzam Jawaid, Wenting Duan, James Brown

机构 * University of Lincoln(林肯大学) Lincolnshire Heart Centre(林肯郡心脏中心) United Lincolnshire Teaching Hospitals Trust(联合林肯郡教学医院信托基金) De Montfort University(德蒙福特大学)

专题命中 医学影像 :CT(title,title_cn);分类 cs.CV

AI总结 该研究提出BCS及可微替代物soft-BCS,用于评估冠状动脉分割的分叉连通性,发现其与FFR-CT决策一致性相关,建议同时报告分支恢复及连通性的度量。

Comments Accepted at STACOM 2026 (MICCAI workshop). 11 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27537 2026-07-31 cs.CV 新提交 90%

ProgFormer: Hierarchical Voxel Diffusion Transformer for Longitudinal Brain MRI Prediction

ProgFormer:用于纵向脑部MRI预测的分层体素扩散Transformer

Dexuan Ding, Yuankai Qi, Luping Zhou, Jian Yang, Quan Z. Sheng, Ming-Hsuan Yang

专题命中 医学影像 :MRI(title,title_cn);分类 cs.CV

AI总结 ProgFormer是一种分层体素扩散Transformer,通过粗-细通路结合条件流匹配,在ADNI等三个基准上实现了更优的纵向脑部MRI预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28565 2026-07-31 cs.CV 新提交 85%

MIND: Multimodal Intent-Driven Network via Diffusion Transformers for Medical Image Fusion

MIND:基于扩散Transformer的多模态意图驱动网络用于医学图像融合

Yunzhan Fu, Xiangyu Shen, Yifei Sun, Yuhan Chen, Jian Wu, Hongxia Xu

机构 * Transvascular Implantation Devices Research Institute, Zhejiang University(浙江大学血管内植入器械研究院) Zhejiang University(浙江大学) Hangzhou Institute of Technology, Xidian University(西安电子科技大学杭州研究院) Hangzhou Dianzi University(杭州电子科技大学)

专题命中 医学影像 :medical image(title,abstract);pathology(abstract);diagnosis(abstract);分类 cs.CV

AI总结 该研究针对现有医学图像融合方法缺乏对诊断意图深度理解的问题,提出基于DiTs的MIND网络,通过BioMedGPT、多尺度潜在适配器和医学语义一致性损失优化,在多数据集上取得优异效果,可提升脑肿瘤分割精度并支持交互式融合。

Comments 14pages, 14 figures, accepted by ACM MM2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27235 2026-07-31 cs.AI cs.CV 新提交 84%

RadHarmony: Radiological Data Handling in the Era of Agentic AI

RadHarmony:智能体AI时代的放射数据处理方案

Frank Li, Bardia Khosravi, Mohammadreza Chavoshi, Theo Dapamede, YoungSeok Jeon, Janice Newsome, Hari Trivedi, Judy Gichoya

机构 * Emory University(埃默里大学) Yale University(耶鲁大学)

专题命中 医学影像 :MRI(abstract,abstract_cn);CT(abstract,abstract_cn);radiology(abstract);分类 cs.CV

AI总结 RadHarmony是一款开源Python库,用于统一处理异构放射数据集,引入AI智能体技能简化数据集整合,可预训练视觉Transformer基线并提供相关代码与模型权重。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27378 2026-07-31 cs.CV cs.MM 新提交 83%

PanDent: Toward Comprehensive Tooth-Level Structure-Language Consistency in Dental Radiology

PanDent:面向牙科放射学中全面的牙级结构-语言一致性

Xiaohan Li, Xinyu Liu, Chang Liu, Sum Wing Au Yeung, Jun Liu, Yixuan Yuan, Hui Chen

机构 * Faculty of Dentistry, The University of Hong Kong(香港大学牙医学院) Imperial College London(帝国理工学院) University of Science and Technology of China(中国科学技术大学) Department of Data and Systems Engineering, The University of Hong Kong(香港大学数据与系统工程系) Department of Electronic Engineering, The Chinese University of Hong Kong(香港中文大学电子工程系)

专题命中 医学影像 :radiology(title,abstract);diagnosis(abstract);分类 cs.CV

AI总结 本研究推出PanDent牙科OPG基准,经实验发现现有MLLM生成的牙科报告流畅但临床一致性差,在PanDent上微调可提升其结构-语言一致性,该基准可用于评估MLLM的牙级临床推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27763 2026-07-31 cs.CV cs.IR cs.LG 新提交 81%

DS@GT ARC at ImageCLEFmedical 2026: Architectural Diversity for Concept Detection and Foundation-Model Scaling for Caption Prediction in Medical Image Analysis

DS@GT ARC参与2026年ImageCLEFmedical任务:医学图像分析中用于概念检测的架构多样性与用于字幕预测的基础模型缩放

Bowen Wang, Youwen Zhang, Ritesh Mehta

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 医学影像 :medical image(title);radiology(abstract);分类 cs.CV、cs.LG

AI总结 该研究介绍DS@GT团队参与2026年ImageCLEFmedical医学图像分析任务,提交不同模型完成概念检测与字幕预测,其中集成模型在概念检测赛道获第一,各模型覆盖不同规模与成本。

Comments 21 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27856 2026-07-31 cs.CV 新提交 79%

Benchmarking Foundation and Large Language Models for Few-Shot Medical Image Segmentation

基准测试用于小样本医学图像分割的基础模型与大语言模型

Jinghong Liu, Yuchuan Deng, Fanping Liu, Meng Huang, Xirong Li

专题命中 医学影像 :medical image(title,abstract);分类 cs.CV

AI总结 该研究推出统一基准FAME,涵盖四类模型,含14958个样本,评估得出小样本分割的关键规律,助力开发更有效的小样本医学分割方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27357 2026-07-31 cs.CV eess.IV 新提交 79%

Shared Semantic Codebook Distillation for Unpaired Cross-Modal Medical Classification

用于非配对跨模态医学分类的共享语义码本蒸馏

Dillan Imans, Phuoc-Nguyen Bui, Duc-Tai Le, Hyunseung Choo

机构 * Sungkyunkwan University(成均馆大学) Convergence Research Institute, Sungkyunkwan University(成均馆大学融合研究院)

专题命中 医学影像 :CT(abstract,abstract_cn);medical image(abstract);分类 cs.CV、eess.IV

AI总结 针对非配对跨模态医学分类的挑战,提出SSCD方法,通过共享语义码本转移知识,在两个医学分类任务中提升学生模型性能,优于各基线方法

Comments 16 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27262 2026-07-31 quant-ph cs.AI cs.ET cs.LG 新提交 74%

LLM-Guided Initialization for Accelerated Hybrid Quantum-Classical Medical Image Classification

大语言模型引导的初始化用于加速混合量子-经典医学图像分类

Riza Alaudin Syah, Irwan Alnarus Kautsar, Haza Nuzly Bin Abdull Hamed

专题命中 医学影像 :medical image(title);分类 cs.LG

AI总结 该研究提出大语言模型引导的AdaInit初始化方法,结合GPU加速量子模拟,在乳腺X线摄影分类任务中,相比随机初始化大幅提升梯度方差与收敛速度,保持相同分类准确率,验证了方法的有效性与兼容性。

Comments Presented at IAICT 2026, Bali, Indonesia

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28047 2026-07-31 cs.GR cs.LG 新提交 70%

A Query-Efficient Stochastic Volume Rendering Framework for Time-Varying Implicit Neural Volumes

面向时变隐式神经体积的查询高效随机体积渲染框架

Alper Sahistan, Haichao Miao, Zhimin Li, Peer-Timo Bremer, Joshua A Levine, Valerio Pascucci

专题命中 医学影像 :CT(abstract,abstract_cn);分类 cs.LG

AI总结 针对时变隐式神经体积渲染的性能挑战,提出基于delta跟踪的查询高效随机体积渲染框架,采用四阶段异构并行流水线,结合光线预算与查询剪枝,在RTX 4090上实现1024×1024分辨率下30-40 FPS及毫秒级时间步更新,支持交互式时变数据探索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27835 2026-07-31 cs.CV cs.AI 新提交 70%

SAFViT: Spatial Attention Fusion Gating for Vision Transformer-Based Nucleus Segmentation and Classification

SAFViT:用于基于视觉Transformer的细胞核分割与分类的空间注意力融合门控

Harshit Mittal, Arash Rabbani

机构 * School of Computer Science, University of Leeds(利兹大学计算机学院)

专题命中 医学影像 :pathology(abstract);diagnosis(abstract);分类 cs.CV

AI总结 本研究针对数字病理学中细胞分割与分类的冗余信息问题,提出SAF门控模块替换CellViT的传统跳跃连接,在PanNuke和MoNuSeg数据集上使mPQ达0.471,死亡类F1分数提升14.5个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28414 2026-07-31 physics.med-ph 新提交 67%

A reduced viscoelastic FDTD formulation for ultrasound-driven shear wave propagation in soft tissue

适用于软组织中超声驱动剪切波传播的简化粘弹性时域有限差分(FDTD)格式

Gianmarco Pinton

专题命中 医学影像 :CT(abstract,abstract_cn)

AI总结 该研究推导了简化粘弹性FDTD格式,用于高效建模软组织中超声驱动剪切波传播,经多类验证其精度高、成本低,可适配异质性组织并与声学模拟器集成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28538 2026-07-31 cs.CV cs.LG 新提交 62%

ScaFE: Data-Efficient Scar Classification with LLM-Generated Clinical Feature Programs

ScaFE:基于大语言模型生成的临床特征程序实现数据高效的瘢痕分类

Ruman Wang, Hangting Ye

专题命中 医学影像 :medical image(abstract);分类 cs.CV、cs.LG

AI总结 ScaFE将LLM临床知识转化为本地可执行的特征程序,结合轻量级随机森林,在瘢痕分类任务中实现数据高效、跨站点的高性能,且决策可审计,优于现有基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27620 2026-07-31 cs.CV 新提交 57%

MedXplore: Towards Reliable and Unbiased Generalized Category Discovery in Medical Imaging

MedXplore:面向医学成像中可靠且无偏的广义类别发现

Jianwei He, Kailin Lyu, Junhao Dong, Long Xiao, Wenjie Hou, Jingze Lu, Di Wu, Lin Shu, Jie Hao

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Nanyang Technological University(南洋理工大学)

专题命中 医学影像 :medical image(abstract);分类 cs.CV

AI总结 针对医学成像中广义类别发现存在的旧类偏差问题,提出MedXplore框架,通过FAAC与ACAM模块优化表征学习,在多基准上实现准确率提升且旧类误报率显著降低。

Comments accepted by ACM MM 26

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 临床大模型 1 篇

2607.27208 2026-07-31 cs.DL 新提交 50%

Bridging openEHR and OMOP: Expanded Mappings and Systematic Analysis of Semantic and Structural Limitations in the OMOP CDM

桥接openEHR与OMOP:扩展映射及OMOP CDM中语义与结构局限性的系统分析

Severin Kohler, Diego Boscá, Falk Meyer-Eschenbach, Prabash Galgane Banduge, Somayeh Abedian, Michael Marschollek, Roland Eils

专题命中 临床大模型 :diagnosis(abstract)

AI总结 该研究针对openEHR与OMOP CDM的互操作性问题,实施新一代Eos与OMOCL扩展映射,评估发现部分术语无法匹配、临床概念在OMOP中碎片化,为两大生态系统融合提供依据。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 诊断辅助 10 篇

2607.28148 2026-07-31 cs.CV cs.LG 新提交 84%

What Makes Deep Learning Work for Traditional Chinese Medicine Tongue Diagnosis? A Comprehensive Ablation Study

深度学习为何能用于中医舌诊?一项全面的消融研究

Longxia Gao, Linan Wang, Yuhe Han, Junze Geng, Meng Zhang, Hanqing Zhao

机构 * College of Traditional Chinese Medicine, Hebei University(河北大学中医学院)

专题命中 诊断辅助 :diagnosis(title,abstract);medical image(abstract);分类 cs.CV、cs.LG

AI总结 该研究通过对中医舌诊数据集开展消融实验,明确了深度学习模型的关键设计原则,为相关多标签医学图像分类任务提供了可推广的依据。

Comments 30 pages, 8 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27443 2026-07-31 cs.AI 新提交 78%

Leveraging Trajectory Graphs for Pre-Execution Error Diagnosis in Agentic LLM Systems

利用轨迹图实现智能体大语言模型系统的预执行错误诊断

Xu Zheng, Zhuomin Chen, Chaohao Lin, Hua Wei, Haifeng Chen, Wei Cheng, Dongsheng Luo

机构 * Florida International University(佛罗里达国际大学) Arizona State University(亚利桑那州立大学) NEC Laboratories America(美国 NEC 实验室) Singapore Management University(新加坡管理大学)

专题命中 诊断辅助 :diagnosis(title,abstract)

AI总结 该研究提出Trajectory Graph Copilot框架,以Graph Debugger为核心,通过预执行错误诊断提升LLM智能体完成长周期任务的能力,在多基准测试中平均提升14.69%通过率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27360 2026-07-31 cs.AI 新提交 78%

SkillMentor: LLM Agent Self-Evolution via Learning Blind-Spot Diagnosis

SkillMentor:基于盲点诊断的大语言模型智能体自我进化

Xiaoyi Bao, Yuanzhen Xie, Yunzhi Tan, Jinghang Gu, Zhongqing Wang, Chu-Ren Huang, Bo Hu, Zang Li

机构 * The Hong Kong Polytechnic University(香港理工大学) Platform and Content Group, Tencent(腾讯平台与内容事业群) Soochow University(苏州大学)

专题命中 诊断辅助 :diagnosis(title,abstract)

AI总结 本文提出SkillMentor,将盲点诊断作为独立于执行的可学习智能体能力,通过强化学习训练导师策略,在AppWorld和BFCLv3上使执行器性能平均提升44.2%,实现无需更新执行器的智能体自我进化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27384 2026-07-31 cs.CL cs.AI 新提交 71%

Same Facts, Different Diagnosis: Measuring and Mitigating Narrative Anchoring in Clinical Language Models

相同事实,不同诊断:临床语言模型中叙事锚定的测量与缓解

Prabhjot Singh, Pritam Deka, Vijay Chennareddy

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Queen’s University Belfast(贝尔法斯特女王大学) Middlesex University London(伦敦密德萨斯大学)

专题命中 诊断辅助 :diagnosis(title)

AI总结 本研究针对临床语言模型的叙事锚定偏差,构建含1000个USMLE案例的基准,提出NarrativeShield三智能体流水线,可大幅降低叙事锚定差距并减少不稳定决策,同时发布数据集供相关研究使用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27386 2026-07-31 cs.AI cs.LG 新提交 57%

Beyond the Bidirectional Promise: Re-evaluating the Robustness of Diffusion Language Models

超越双向承诺:重新评估扩散语言模型的鲁棒性

Saurabh Yadav, Badri Narayana Patro, Vijay Srinivas Agneeswaran

机构 * Microsoft(微软公司)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 该研究评估了扩散语言模型的鲁棒性,发现其虽能抵御部分对抗攻击但易受自然噪声影响,存在过度自信问题,脆弱性源于解码器路由故障,需将鲁棒性整合入迭代解码循环。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27888 2026-07-31 cs.AI 新提交 50%

Not All Tokens Deserve Equal Credit: Counterfactual Sensitivity Credit Reallocation for Long-CoT Reasoning

并非所有 token 都应获得同等权重:面向长思维链(Long-CoT)推理的反事实敏感性权重重分配

Qiangqiang He, Zhongheng Wu, ZiJian Wang

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(南京大学现代软件技术国家重点实验室) Institute of Wireless Communications Technology, Shanghai Jiao Tong University(上海交通大学无线通信技术研究所)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 针对长思维链推理中均匀分配 token 权重的缺陷,提出反事实敏感性权重重分配方法,在数学推理基准上优于 GRPO,验证了特权诱导方向不可靠的诊断。

Comments 20 pages, 6 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27798 2026-07-31 cs.AI 新提交 50%

MemeBench: What LVLMs Miss When Interpreting Culture-Dependent Memes

MemeBench:大型视觉语言模型在解读依赖文化的梗图时所缺失的内容

Weihang Wang, Kainan Tu, Jielei Zhang, Run Yang, Boheng Sheng, Yuchen He, Yu Xie, Pengyu Chen, Peiyi Li, Huyang Sun, Longwen Gao, Zhouhui Lian

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究针对LVLMs解读文化类梗图的知识缺口问题,推出诊断基准MemeBench及实体引导检索基线KAR,验证了检索手段可提升梗图解读的VIKR成功率。

Comments 17 pages, 5 figures, and 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27586 2026-07-31 cs.CY cs.AI 新提交 50%

Is Solving Better Than Evaluating GenAI Solutions?

解决生成式AI(GenAI)方案比评估更好吗?

Ethan Dickey, Marios Mertzanidis, Alexandros Psomas

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 通过220名大三算法课学生的随机A/B交叉研究发现,评估GenAI方案与传统解题的整体成绩无显著差异,仅作业成绩局部更高,需刻意支架式教学才能获得学习收益。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28161 2026-07-31 stat.ME math.ST stat.ML stat.TH 新提交 50%

A Mathematical Framework for Topological Causal Data Analysis

拓扑因果数据分析的数学框架

Hugo Gobato Souto, Ioannis Diamantis

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 该研究提出拓扑因果数据分析(TCDA)框架,区分结果级与分布级TCDA,构建对应识别与表示方法,明确观测拓扑在因果发现中的作用,为结构化对象的因果分析提供数学基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27414 2026-07-31 astro-ph.IM astro-ph.EP astro-ph.GA astro-ph.SR 新提交 50%

PhoPS: An automated photometric pipeline for survey-era astronomy

PhoPS:面向勘测时代天文学的自动测光流水线

Orhan Erece, Yucel Kilic

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 针对现代天文勘测的海量数据需求,研究人员开发了开源自动测光天体测量流水线 PhoPS,通过动态 Gaia DR3 索引与 RANSAC 零点模型提升精度,适用于小行星光变等天文研究。

Comments 11 pages, 9 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 病理影像 1 篇

2607.28007 2026-07-31 cs.CV cs.AI 新提交 79%

Beyond Classification: Pathology Foundation Models as Detection Encoders for Mitotic Figures

超越分类:病理学基础模型作为有丝分裂图的检测编码器

Sweta Banerjee, Alireza Teimoury, Nils Porsche, Alexandra K. Stoll, Viktoria Weiss, Niklas Hargarter, Jonas Ammeling, Thomas Conrad, Christoph Stroblberger, Christopher Kaltnecker, Robert Klopfleisch, Christof A. Bertram, Katharina Breininger, Marc Aubreville

机构 * Flensburg University of Applied Sciences(弗伦斯堡应用科学大学) University of Veterinary Medicine, Vienna(维也纳兽医大学) Freie Universität Berlin(柏林自由大学) Technische Hochschule Ingolstadt(英戈尔施塔特应用技术大学) Medical University of Vienna(维也纳医科大学) Julius-Maximilians-Universität Würzburg(维尔zburg大学) Friedrich-Alexander-Universität Erlangen-Nürnberg(埃尔朗根-纽伦堡弗里德里希-亚历山大大学)

专题命中 病理影像 :pathology(title,abstract);分类 cs.CV

AI总结 本研究将多种病理学基础模型作为骨干网络,结合不同类型检测器在MIDOG++和TUPAC16数据集上验证其用于有丝分裂图检测的性能,发现H-optimus-0和Virchow模型表现具竞争力,相关代码已公开。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 医疗多模态 5 篇

2607.27289 2026-07-31 cs.LG 新提交 79%

TIER-MoE: Trust-Informed Expert Routing via Conditional Modality Risk for Multimodal Fusion in Biomedical Classification

TIER-MoE:用于生物医学分类多模态融合的、基于条件模态风险的信任感知专家路由

Yu Chang, Anzhe Cheng, Chenwei Wu, Zhuoran Wang, Jiahao Chen, Tamoghna Chattopadhyay, Sophia I. Thomopoulos, Paul M. Thompson, Liyue Shen, Paul Bogdan

专题命中 医疗多模态 :biomedical(title,abstract);分类 cs.LG

AI总结 该研究提出TIER-MoE风险引导子空间混合专家模型,用于生物医学分类多模态融合,可提升预测性能与概率校准,在多数据集上优于现有最优方法且具备强零样本泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28318 2026-07-31 cs.AI 新提交 78%

PathView-Bench: Can Multimodal Large Language Models Achieve Fine-grained Multiscale Understanding of Pathology Images?

PathView-Bench:多模态大语言模型能否实现病理图像的细粒度多尺度理解?

Zongyi Chen, Yu Liang, Jie Lin, Liansheng Wang

机构 * National Institute for Data Science in Health and Medicine, Xiamen University(厦门大学健康与医学数据科学国家研究院)

专题命中 医疗多模态 :pathology(title,abstract)

AI总结 研究针对现有病理多模态基准的不足,推出PathVU基准,评估发现主流MLLMs在多尺度病理图像细粒度视觉任务上存在显著局限,为相关模型的开发评估提供了可复现基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27779 2026-07-31 cs.CV 新提交 70%

CXR-Retrieve: Compositional Text-to-Image Retrieval in Chest Radiography

CXR-Retrieve:胸部X线摄影中的组合式文本到图像检索

Tomer Erez, Moshe Kimhi, Chaim Baskin, Ehud Rivlin

机构 * Technion – Israel Institute of Technology(以色列理工学院) Ben-Gurion University of the Negev(内盖夫本-古里安大学)

专题命中 医疗多模态 :pathology(abstract);biomedical(abstract);分类 cs.CV

AI总结 针对胸部X线检索的目标不匹配问题,提出CXR-Retrieve基准与标签感知对比微调方法,在双病理组合和否定查询的Precision@5上较CXR-CLIP分别提升8.5和22.0个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏