arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

2026-05-29 至 2026-05-29 共收录 6 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 医学数据与评测 6 篇

2603.14644 2026-05-29 eess.IV cs.CV cs.DB cs.LG 75%

LUMINA: A Multi-Vendor Mammography Benchmark with Energy Harmonization Protocol

LUMINA:采用能量协调协议的多供应商乳腺X线摄影基准

Hongyi Pan, Gorkem Durak, Halil Ertugrul Aktas, Andrea M. Bejar, Baver Tutun, Emre Uysal, Ezgi Bulbul, Mehmet Fatih Dogan, Berrin Erok, Berna Akkus Yildirim, Sukru Mehmet Erturk, Ulas Bagci

机构 * Department of Radiology, Northwestern University(北western大学放射科) Department of Radiation Oncology, University of Health Sciences Prof. Dr. Cemil Tascioglu City Hospital(健康科学大学教授Dr. Cemil Tascioglu医院放射肿瘤科) Department of Radiology, Istanbul University(伊斯坦布尔大学放射科)

专题命中 医学数据与评测 :pathology(abstract);diagnosis(abstract);分类 cs.CV、cs.LG、eess.IV

AI总结 为解决现有FFDM数据集规模小、标注少和供应商多样性不足的问题,提出LUMINA多供应商数据集及能量协调方法,通过前景像素对齐减少域偏移,在诊断、BI-RADS分类和密度估计任务上验证了模型性能提升。

Comments This paper was accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29720 2026-05-29 cs.CV cs.LG 62%

Efficient, Validation-Free Intrinsic Quality Estimation for Large-Scale Face Recognition Datasets

面向大规模人脸识别数据集的高效、免验证的内在质量评估

Zhichao Chen, Yongle Zhao, Kaicheng Yang, Meng Yang, Yin Xie, Ziyong Feng

机构 * School of Cyber Science and Technology, University of Science and Technology of China(中国科学技术大学网络科学与技术学院)

专题命中 医学数据与评测 :diagnosis(abstract);分类 cs.CV、cs.LG

AI总结 提出一种无需训练的内在质量(IQ)指标,通过邻域一致性得分和全局表示子空间复杂度来估计人脸识别数据集生成高性能模型的潜力,实现快速数据集诊断与筛选。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30219 2026-05-29 cs.AI cs.CL cs.LG 57%

When Should Models Change Their Minds? Contextual Belief Management in Large Language Models

模型何时应改变想法?大语言模型中的上下文信念管理

Haoming Xu, Weihong Xu, Zongrui Li, Mengru Wang, Yunzhi Yao, Chiyu Wu, Jin Shang, Yu Gong, Shumin Deng

机构 * Zhejiang University(浙江大学) HomologyAI

专题命中 医学数据与评测 :diagnosis(abstract);分类 cs.LG

AI总结 提出上下文信念管理(CBM)框架,通过引入BeliefTrack基准和信念状态奖励的强化学习,将大语言模型在长程交互中的信念更新失败率平均降低70.9%。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28844 2026-05-29 cs.NE cs.LG 57%

WASHH: An Anchor-Aware Whale-Guided Selection Hyper-Heuristic for Continuous Optimization and SVC Configuration

WASHH:一种用于连续优化和SVC配置的锚点感知鲸鱼引导选择超启发式算法

Yifu Zhao, Xiaofan Zou, Junhao Wei, Yanxiao Li, Baili Lu, Zhenhong Peng, Dexing Yao, Haochen Li, Qinbin He, Sio-Kei Im, Xu Yang, Yapeng Wang

机构 * Faculty of Applied Sciences, Macao Polytechnic University(澳门理工学院应用科学学院) School of Mechanical and Electrical Engineering and Automation, Shanghai University(上海大学机械与自动化工程学院) Pazhou Lab (Huangpu), Guangzhou(广州 Pazhou 实验室(黄埔)) College of Animal Science and Technology, Zhongkai University of Agriculture and Engineering(仲恺农业工程学院动物科学与技术学院) Macao Polytechnic University(澳门理工学院)

专题命中 医学数据与评测 :diagnosis(abstract);分类 cs.LG

AI总结 提出WASHH超启发式算法,通过在线奖励控制器选择多种搜索行为,在连续优化和SVC超参数配置中取得最优平均排名和最低验证损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29274 2026-05-29 cs.CL 50%

Learnable Assessment Skills for LLM-based Automated Scoring: Rubric Construction via Iterative Optimization

基于LLM的自动评分中可学习的评估技能:通过迭代优化构建评分标准

Yun Wang, Xin Xia, Xuansheng Wu, Xiaoming Zhai, Ninghao Liu

机构 * School of Computing, University of Georgia, Athens, GA, USA(佐治亚大学计算机学院) AI4STEM Education Center, University of Georgia, Athens, GA, USA(佐治亚大学AI4STEM教育中心) The Hong Kong Polytechnic University, Hong Kong, China(香港理工大学)

专题命中 医学数据与评测 :diagnosis(abstract)

AI总结 提出一种迭代框架,使LLM能从评分经验中学习评估技能(即与题目无关的自然语言程序性知识),自动构建评分标准,无需人工干预,在ASAP-SAS数据集上超越专家编写的评分标准。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29225 2026-05-29 cs.AI 50%

BenchTrace: A Benchmark for Testing Reflection Ability and Controlled Evolution in LLM Agents

BenchTrace: 用于测试LLM智能体反思能力和受控进化的基准

Jiahao Huang, Fei Cheng, Junfeng Jiang, Zefan Yu, Akiko Aizawa

机构 * University of Tokyo(东京大学) Kyoto University(京都大学) National Institute of Informatics(日本信息处理学会)

专题命中 医学数据与评测 :diagnosis(abstract)

AI总结 提出BenchTrace基准,通过反思评估和进化评估两个任务,结合失败避免率(FAR)指标,系统评估LLM智能体的自我进化能力,实验发现当前模型在反思诊断和泛化上存在显著瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏