arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

2026-05-28 至 2026-05-28 共收录 59 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 诊断辅助 13 篇

2605.27760 2026-05-28 cs.AI 50%

SkillGrad: Optimizing Agent Skills Like Gradient Descent

SkillGrad: 像梯度下降一样优化智能体技能

Hanyu Wang, Yifan Lan, Bochuan Cao, Lu Lin, Jinghui Chen

机构 * College of Information Sciences and Technology(信息科学与技术学院) The Pennsylvania State University(宾夕法尼亚州立大学) University Park, PA, USA

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 提出SkillGrad框架,将技能包视为结构化参数,通过轨迹级损失、文本梯度诊断和动量记忆覆盖进行类梯度下降优化,在表格问答任务上平均提升6.7个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27715 2026-05-28 cs.CL 50%

Beyond Input Understanding: Diagnosing Multilingual Mathematical Reasoning with Directed Acyclic Trace Graphs

超越输入理解:使用有向无环迹图诊断多语言数学推理

Jiaqiao Zhang, Zhoujun Li, Raoyuan Zhao, Jian Lan, Thomas Seidl, Michael A. Hedderich, Hinrich Schütze, Yihong Liu

机构 * Southwest University(西南大学) LMU Munich(慕尼黑莱茵-瓦尔德大学) MCML

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本文提出有向无环迹图(DATG)框架,通过将推理迹映射到与语言无关的数学锚点和依赖关系,诊断多语言数学推理中的语言影响,并设计Loop-Retry和Formula-Retry两种测试时控制方法改善低资源语言性能。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27388 2026-05-28 cs.CL cs.AI cs.SI 50%

Modeling Community Attitude through Reaction Tone: A Human-AI Collaborative Framework for Evaluating LLM Alignment with Linguistic Behaviors in Online Communities

通过反应语气建模社区态度:评估LLM与在线社区语言行为对齐的人机协作框架

Nuan Wen, Xuezhe Ma

机构 * Information Sciences Institute University of Southern California(南加州大学信息科学研究所)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 提出CARE框架,通过细粒度言语气势分析,评估LLM模拟社区对真实新闻的反应,揭示其存在“现实主义差距”,表明当前对齐策略不足以捕捉在线群体的社会语言动态。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14356 2026-05-28 cs.CL cs.AI 50%

When PCOS Meets Eating Disorders: An Explainable AI Approach to Detecting the Hidden Triple Burden

当多囊卵巢综合征遇上进食障碍:一种可解释的AI方法检测隐藏的三重负担

Apoorv Prasad, Susan McRoy

机构 * University of Wisconsin - Milwaukee(威斯康星大学密尔沃基分校)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本研究通过微调小型开源语言模型,利用可解释性AI从社交媒体帖子中自动检测多囊卵巢综合征患者的身体形象困扰、进食障碍和代谢挑战的三重负担,最佳模型在150条测试帖上达到75.3%的精确匹配准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26182 2026-05-28 cs.CL 50%

ClinicalAgents: Multi-Agent Orchestration for Clinical Decision Making with Dual-Memory

ClinicalAgents:具有双记忆的临床决策多智能体编排

Zhuohan Ge, Haoyang Li, Yubo Wang, Nicole Hu, Chen Jason Zhang, Qing Li

机构 * The Hong Kong Polytechnic University(香港理工大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 提出ClinicalAgents多智能体框架,通过蒙特卡洛树搜索动态编排和双记忆架构模拟临床推理,显著提升诊断准确性和可解释性。

Comments Accepted to the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10185 2026-05-28 cs.CL cs.AI cs.MA 50%

Auditing medical multi-agent AI reveals risks of false consensus

审计医疗多智能体AI揭示虚假共识风险

Yinghao Zhu, Lei Gu, Zixiang Wang, Haoran Sang, Dehao Sui, Wen Tang, Lan Mi, Yasha Wang, Junyi Gao, Liang Yao, Tianfan Fu, Ewen Harrison, Lequan Yu, Liantao Ma

机构 * National Engineering Research Center for Software Engineering, Peking University(北京大学软件工程国家工程研究中心) School of Computing and Data Science, The University of Hong Kong(香港大学计算机与数据科学学院) Department of Nephrology, Peking University Third Hospital(北京大学第三医院肾内科) Key Laboratory of Carcinogenesis and Translational Research (Ministry of Education), Department of Lymphoma, Peking University Cancer Hospital & Institute(教育部癌症发生与转化研究重点实验室、北京大学肿瘤医院淋巴瘤科) Department of Automation, Tsinghua University(清华大学自动化系) Centre for Medical Informatics, The University of Edinburgh(爱丁堡大学医学信息学中心) Health Data Research UK(英国健康数据研究机构) Lee Kong Chian School of Medicine, Nanyang Technological University(南洋理工大学李科贤医学院) State Key Laboratory for Novel Software Technology, School of Computer Science, Nanjing University(南京大学新型软件技术国家重点实验室、计算机科学学院)

专题命中 诊断辅助 :medical AI(abstract)

AI总结 本研究提出MedAgentAudit框架,通过专家验证的审计流程诊断医疗多智能体系统中的协作失败模式,发现虚假共识、权威偏差等系统性风险。

Comments Code and Data: https://github.com/MedX-PKU/MedAgentAudit

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 病理影像 5 篇

2511.14558 2026-05-28 cs.CV 80%

Explaining Digital Pathology Models via Clustering Activations

通过激活聚类解释数字病理学模型

Adam Bajger, Jan Obdržálek, Vojtěch Kůr, Rudolf Nenutil, Petr Holub, Vít Musil, Tomáš Brázdil

机构 * Faculty of Informatics, Masaryk University, Brno, Czech Republic(马萨里克大学信息学院,布拉格,捷克共和国) Institute of Computer Science, Masaryk University, Brno, Czech Republic(马萨里克大学计算机科学研究所,布拉格,捷克共和国) Masaryk Memorial Cancer Institute, Brno, Czech Republic(马萨里克纪念癌症研究所,布拉格,捷克共和国)

专题命中 病理影像 :pathology(title,abstract);分类 cs.CV;biomedical(journal_ref)

AI总结 提出一种基于卷积神经网络激活聚类的可解释性方法,通过展示模型全局行为并提供细粒度信息,增强对数字病理学模型的理解和信任。

Journal ref 2026 IEEE 23rd International Symposium on Biomedical Imaging (ISBI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27919 2026-05-28 cs.RO cs.LG 57%

Frequency-Guided Action Diffusion via Sub-Frequency Manifold Traversal

通过子频率流形遍历的频率引导动作扩散

Junlin Wang

机构 * School of Engineering and Applied Science University of Pennsylvania(工程与应用科学学院 费城大学)

专题命中 病理影像 :pathology(abstract);分类 cs.LG

AI总结 提出频率引导算子(FGO),通过子频率流形逐步引导扩散策略生成平滑动作,在15个机器人操作任务上提升了动作平滑性和时间一致性。

Comments A preprint version of FGO

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03515 2026-05-28 cs.LG cs.AI cs.DC 57%

Mitigating Staleness in Asynchronous Pipeline Parallelism via Basis Rotation

通过基旋转缓解异步流水线并行中的陈旧性问题

Hyunji Jung, Sungbin Shin, Namhoon Lee

机构 * POSTECH(POSTECH大学)

专题命中 病理影像 :pathology(abstract);分类 cs.LG

AI总结 针对异步流水线并行中梯度陈旧性随流水线深度线性增长的问题,提出基旋转框架,通过将优化器坐标系与Hessian特征基对齐来保持延迟更新的有效性,理论证明最小化基失配并实证在3B参数LLM训练中减少81.7%迭代次数。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01450 2026-05-28 cs.LG cs.AI cs.RO 57%

Investigating Memory in Model-Free RL with POPGym Arcade

基于POPGym Arcade的无模型强化学习中的记忆研究

Zekang Wang, Zhe He, Borong Zhang, Edan Toledo, Steven Morad

机构 * Faculty of Science and Technology, University of Macau(澳门大学科技学院) Centre for AI, University College London(伦敦大学学院人工智能中心)

专题命中 病理影像 :pathology(abstract);分类 cs.LG

AI总结 本文通过引入分析工具和POPGym Arcade环境套件,研究深度强化学习中的记忆机制,发现价值函数会将信用分配到无关历史,并展示分布外场景如何污染记忆。

Comments Appear at ICML 2026 as a Spotlight paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28303 2026-05-28 cs.AI 50%

From Fact Overwriting to Knowledge Evolution: Causal Editing via On-Policy Self-Distillation

从事实覆写到知识演化:基于同策略自蒸馏的因果编辑

Shuaike Li, Kai Zhang, Xianquan Wang, Jiachen Liu, Shengpeng Mo

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室)

专题命中 病理影像 :pathology(abstract)

AI总结 针对知识编辑中静态事实覆写范式导致认知失调的问题,提出基于因果引导的同策略蒸馏方法CODE,将事实注入转化为连贯的知识演化,显著降低自反驳率并提升多跳准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 医疗多模态 2 篇

2605.27916 2026-05-28 cs.CV cs.CL 57%

OphIn-500K: Curating Web-Scale Visual Instructions for Scaling Ophthalmic Multimodal Large Language Models

OphIn-500K:策划网络规模的视觉指令以扩展眼科多模态大语言模型

Xuanzhao Dong, Wenhui Zhu, Xiwen Chen, Hao Wang, Xin Li, Yujian Xiong, Jiajun Cheng, Jingjing Wang, Xiaobing Yu, Haiyu Wu, Shao Tang, Zhipeng Wang, Langechuan Liu, Shan Lin, Oana Dumitrascu, Yalin Wang

机构 * Arizona State University(亚利桑那州立大学) Clemson University(克莱姆森大学) Washington University in St. Louis(圣路易斯华盛顿大学) University of Notre Dame(诺特丹大学) Florida State University(佛罗里达州立大学) Rice University(里德大学) NVIDIA(英伟达) Mayo Clinic(梅奥诊所)

专题命中 医疗多模态 :diagnosis(abstract);分类 cs.CV

AI总结 提出OphIn-Engine流水线从网络视频中构建高质量眼科指令数据,生成包含50万+指令实例的OphIn-500K数据集,并基于此开发眼科专用多模态大语言模型OphIn-VL,在多项任务上超越现有通用医学和专用模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27583 2026-05-28 cs.LG 57%

Information-theoretic Multimodal Representation Learning for Electrocardiogram Signals

基于信息论的心电图信号多模态表示学习

Phu X. Nguyen, Konstantinos Kontras, Wei Dai, Huy Phan, Christos Chatzichristos, Paul Pu Liang, Bert Vandenberk, Maarten De Vos

机构 * KU Leuven(库勒芬大学) University Hospitals Leuven(鲁文大学医院) MIT(麻省理工学院) DFKI(德国达姆施塔特研究所)

专题命中 医疗多模态 :diagnosis(abstract);分类 cs.LG

AI总结 提出MERIT框架,通过信息论视角结合掩码心电图建模与心电图-文本对比对齐,学习保留信号结构并整合临床语义的心电图表示,在分类、零样本和文本生成任务中取得一致提升。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 生物医学文本 8 篇

2605.28375 2026-05-28 cs.CL 79%

PrionNER: A Named Entity Recognition Dataset for Prion Disease Biomedical Literature

PrionNER: 朊病毒病生物医学文献命名实体识别数据集

An Dao, Nhan Ly, Thao Tran, Yuji Matsumoto, Akiko Aizawa

机构 * The University of Tokyo(东京大学) Medical Doctor, Independent Researcher(医学博士,独立研究员) Center for Language AI Research, Tohoku University(语言人工智能研究中心,东北大学) RIKEN Center for Advanced Intelligence Project(日本理化学研究院高级智能项目中心) National Institute of Informatics(信息机构国家研究所)

专题命中 生物医学文本 :biomedical(title,abstract)

AI总结 针对朊病毒病临床信息,构建了手动标注的命名实体识别数据集PrionNER,包含317篇摘要、15种粗粒度和31种细粒度实体类型,并评估了监督和零样本模型性能。

Comments 29 pages, 5 figures, accepted at ACL 25th Workshop on Biomedical Language Processing (BioNLP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28363 2026-05-28 cs.CL 78%

PubMedCausal: A Span-Level Annotated Corpus for Causal Relation Extraction in Biomedical Text

PubMedCausal: 用于生物医学文本中因果关抽取的跨度级标注语料库

Ifeoluwa Kunle-John, Josiah Paul, Oluwatosin Agbaakin, Peter Aina, Ikenna Odezuligbo, Sydney Anuyah

机构 * Edyah Limited(Edyah有限公司) University of Ibadan(伊巴丹大学) Indiana University(印第安纳大学) Creighton University(克雷顿大学)

专题命中 生物医学文本 :biomedical(title,abstract)

AI总结 为解决现有资源将因果关系与广义关联混淆、限制句子级标注或仅关注显式因果线索的问题,构建了基于PubMed摘要的跨度级因果关抽取语料库PubMedCausal,包含30,000段落级行、3,945因果行和6,491个裁决的因果对,并基准测试了判别式编码器和开源生成模型。

Comments Submitted to EMNLP 2026, 8 Pages, 23 page appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27380 2026-05-28 cs.CL cs.AI 78%

BioELX: Cross-lingual Biomedical Entity Linking via Alias-based Retrieval and LLM Ranking

BioELX: 基于别名的检索与LLM排序的跨语言生物医学实体链接

Yi Wang, Corina Dima, Liangyu Zhong, Steffen Staab

机构 * University of Stuttgart, Germany(斯图加特大学) Technical University of Berlin, Germany(柏林技术大学)

专题命中 生物医学文本 :biomedical(title,abstract)

AI总结 提出BioELX两阶段框架,通过维基数据多语言别名增强SapBERT检索器,并利用预训练LLM排序器进行上下文感知消歧,无需标注数据即在多个基准上取得最佳性能。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27858 2026-05-28 cs.CL cs.AI cs.LG 57%

DecomposeRL: Learning to Ask Useful, Informative, and Diverse Questions for Semi-Supervised, Traceable Claim Verification

DecomposeRL: 学习提出有用、信息丰富且多样的问题以进行半监督、可追踪的声明验证

Shubhashis Roy Dipta, Ankur Padia, Francis Ferraro

机构 * Department of Computer Science and Electrical Engineering(计算机科学与电气工程系)

专题命中 生物医学文本 :biomedical(abstract);分类 cs.LG

AI总结 提出DecomposeRL框架,通过GRPO和多面奖励集成将声明分解为可追踪的子问题,在完全监督和半监督设置下实现高精度,且模型规模小4倍仍匹配大模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28655 2026-05-28 cs.AI 50%

AutoScientists: Self-Organizing Agent Teams for Long-Running Scientific Experimentation

AutoScientists: 用于长期科学实验的自组织智能体团队

Shanghua Gao, Ada Fang, Marinka Zitnik

机构 * Harvard University(哈佛大学)

专题命中 生物医学文本 :biomedical(abstract)

AI总结 提出一种去中心化的AI智能体团队系统AutoScientists,通过自组织协作、提案评审和失败知识共享,在生物医学机器学习、语言模型训练优化和蛋白质适应性预测等长期实验中显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28521 2026-05-28 cs.CL 50%

ClinicalEncoder26AM: A Multlilingual Diagnosable ColBERT Model; Evidences from the MultiClinNER Shared Task

ClinicalEncoder26AM:一个多语言可诊断的ColBERT模型——来自MultiClinNER共享任务的证据

François Remy

机构 * Parallia AI

专题命中 生物医学文本 :biomedical(abstract)

AI总结 本文提出ClinicalEncoder26AM,一个基于BGE-M3的多语言可诊断ColBERT模型,通过多适配器蒸馏和ColBERT式检索目标进行临床后训练,在MultiClinNER任务中微调为BIO标注器,实现了最先进的多语言实体召回率和字符加权F1分数前五。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28506 2026-05-28 physics.optics 50%

Toward Micro-Endoscopy: Distal-Free, Configuration-Agnostic Focusing Through Multimode Fiber

迈向显微内窥镜:基于多模光纤的无远端、配置无关聚焦

Dvir Marsh, Lior Fridman, Stav Lotan, Amit Kam, Shie Mannor, Guy Bartal

专题命中 生物医学文本 :biomedical(abstract)

AI总结 提出一种仅通过反射信号预测多模光纤传输的深度学习框架,实现无需传输反馈的聚焦,并在1200种光纤配置下验证了鲁棒波前重建。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28448 2026-05-28 cs.RO 50%

A Digital Twin Framework for Virtual Visuo-Haptic Teleoperation of Complex-Shaped Optical Microrobots

复杂形状光学微机器人的虚拟视觉-触觉遥操作数字孪生框架

Zongcai Tan, Lan Wei, Dandan Zhang

机构 * Department of Bioengineering, Imperial-X AI Initiative, Imperial College London(生物工程系、Imperial-X人工智能倡议、帝国理工学院伦敦分校)

专题命中 生物医学文本 :biomedical(abstract)

AI总结 本文提出一个数字孪生框架,集成多陷阱光学操纵、图像位姿估计、微机器人运动仿真和基于模型的触觉渲染,用于复杂形状光学微机器人的虚拟视觉-触觉遥操作,实验表明触觉反馈显著降低接触力和位置误差标准差并提高任务成功率。

Comments Accepted by 2026 MARSS

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 健康监测 2 篇

1901.03808 2026-05-28 cs.LG eess.SP stat.ML 62%

ECGadv: Generating Adversarial Electrocardiogram to Misguide Arrhythmia Classification System

ECGadv: 生成对抗性心电图以误导心律失常分类系统

Huangxun Chen, Chenyu Huang, Qianyi Huang, Qian Zhang, Wei Wang

机构 * The Hong Kong University of Science and Technology(香港科技大学) Southern University of Science and Technology, Peng Cheng Laboratory(南方科技大学鹏城实验室) Huazhong University of Science and Technology(华中科技大学)

专题命中 健康监测 :diagnosis(abstract);分类 cs.LG、eess.SP

AI总结 本文针对基于深度神经网络的心电图诊断系统,分析心电图特性并设计两种攻击模型下的对抗攻击方案,揭示系统盲点,呼吁采取对策。

Comments Accepted by AAAI 2020

Journal ref Proceedings of the AAAI conference on artificial intelligence 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28563 2026-05-28 cs.LG cs.AI 57%

A Multi-dimensional Framework for Evaluating Generalization in EEG Foundation Models

评估脑电图基础模型泛化能力的多维框架

Aditya Kommineni, Emily Zhou, Kleanthis Avramidis, Tiantian Feng, Shrikanth Narayanan

机构 * Signal Analysis and Interpretation Laboratory(信号分析与解释实验室)

专题命中 健康监测 :biomedical(abstract);分类 cs.LG

AI总结 提出一个多维评估框架,在低资源条件下系统评估EEG基础模型(如LaBraM、CSBrain、CBraMod)的泛化能力,发现其在长上下文任务中表现优异,但在短窗口BCI任务中与监督模型相当,且对通道限制鲁棒性不足。

Comments 24 pages, 5 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 医学数据与评测 5 篇

2605.28161 2026-05-28 cs.CV 84%

MeniOmni: A Structured Multimodal Benchmark for Holistic Meniscus Injury Assessment

MeniOmni:用于整体半月板损伤评估的结构化多模态基准

Shurui Xu, Siqi Yang, Weiping Ding, Hui Wang, Mengzhen Fan, Yuyu Sun, Shuyan Li

机构 * 1School of Electronics, Electrical Engineering Computer Science, Queen's University Belfast, Belfast, UK 2Radiology Department, Affiliated Nantong Clinical College of Nantong University, Nantong First People's Hospital, School of Clinical Medicine, Nantong University, Nantong, Jiangsu, China 3School of Artificial Intelligence Computer Science, Nantong University, Nantong, China 4Faculty of Data Science, City University of Macau, Macau, China 5Department of Chemistry, University of Oxford, Oxford, UK 6Orthopedics Department, Nantong First People's Hospital, Southeast University, Nantong, Jiangsu, China

专题命中 医学数据与评测 :MRI(summary_cn,abstract);diagnosis(abstract);分类 cs.CV

AI总结 提出MeniOmni基准,包含多中心MRI、临床先验和专家标注文本,支持细粒度Stoller分级和诊断报告生成,并引入风险感知序数评估和语义一致性指标Meni-Score。

Comments Accepted by IEEE International Conference on Multimedia and Expo (ICME) 2026 (Oral Presentation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17110 2026-05-28 cs.CV 57%

From Clinical Intent to Clinical Model: Autonomous Coding-Agents for Clinician-driven AI Development

从临床意图到临床模型:面向临床医生驱动AI开发的自主编码代理

Zihao Zhao, Frederik Hauke, Juliana De Castilhos, Mathis Bode, Jakob Nikolas Kather, Sven Nebelung, Daniel Truhn

专题命中 医学数据与评测 :clinical AI(abstract);分类 cs.CV

AI总结 提出一种自主编码代理系统,允许临床医生用自然语言描述任务,系统自动生成并迭代优化模型,在五项临床任务中达到竞争性能,并显著减少胸部X光片模型对胸腔引流管的依赖。

Comments Code is available at https://github.com/zhaozh10/clinical-automata/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28129 2026-05-28 cs.AI 50%

Do Clinical Models Change Treatment Decisions?

临床模型是否会改变治疗决策?

Dongkyu Cho, Miao Zhang, Rumi Chunara

机构 * New York University(纽约大学)

专题命中 医学数据与评测 :biomedical(abstract)

AI总结 本研究提出ClinPivot基准,通过生物医学关系和变化的患者情境评估临床基础模型在治疗决策中的适应性,发现强医学QA能力不能可靠预测决策表现。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28035 2026-05-28 cs.AI cs.MM cs.SD 50%

MTAVG-Bench 2.0: Diagnosing Failure Modes of Cinematic Expressiveness in Multi-Talker Audio-Video Generation

MTAVG-Bench 2.0:诊断多说话人音视频生成中电影表现力的失败模式

Haitian Li, Yanghao Zhou, Heyan Huang, Liangji Chen, YiMing Cheng, Xu Liu, Dian Jin, Jiajun Xu, Jingyun Liao, Tian Lan, Ziqin Zhou, Yueying Liu, Yu Bai, Changsen Yuan, Jinxing Zhou, Xian-Ling Mao, Xuefeng Chen, Yousheng Feng

机构 * Shanghai University(上海大学) Beijing Institute of Technology(北京理工大学) Shanghai Film Academy(上海电影学院) Tsinghua University(清华大学) Hefei University of Technology(合肥工业大学) Inkeverse Group Limited(Inkeverse集团有限公司) The University of Adelaide(阿德莱德大学) Beijing University of Technology(北京工业大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) OpenNLP Lab(OpenNLP实验室)

专题命中 医学数据与评测 :diagnosis(abstract)

AI总结 针对多说话人音视频生成中电影表现力评估不足的问题,提出MTAVG-Bench 2.0基准,通过构建涵盖表演、叙事、氛围和视听语言的高层次失败分类体系及超过1万个问答实例,系统评估全模态大语言模型诊断复杂视听失败的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27827 2026-05-28 cs.AI cs.CY 50%

Operational AI Deployment Assurance: Governance-State Orchestration Under Threshold-Sensitive Deployment Conditions -- A Governance Framework for High-Stakes AI Systems

运营级AI部署保障:阈值敏感部署条件下的治理状态编排——高风险AI系统的治理框架

Khalid Adnan Alsayed

机构 * Ducaltus | AI Assurance \& Governance Newcastle upon Tyne, United Kingdom School of Computing, Engineering \& Digital Technologies Teesside University Middlesbrough, United Kingdom

专题命中 医学数据与评测 :healthcare AI(abstract)

AI总结 提出运营级AI部署保障(OADA)框架,通过部署保障分数、就绪分类、阈值稳定区、治理升级状态和修复感知保障推进等机制,将公平性分歧、子组不稳定性和阈值敏感性转化为部署导向的治理决策,以解决高风险AI系统中静态指标报告和事后审计的不足。

Comments 13 pages, 3 figures, governance-oriented framework for operational AI deployment assurance in high-stakes systems

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他医学AI 1 篇

2605.28070 2026-05-28 cs.AI 50%

Bridging the Detection-to-Abstention Gap in Reasoning Models under Insufficient Information

弥合推理模型在信息不足情况下的检测到弃权差距

Renjie Gu, Jiaxu Li, Yihao Wang, Yun Yue, Hansong Xiao, Yefei Chen, Yuan Wang, Chunxiao Guo, Pei Wei, Jinjie Gu, Yixin Cao

机构 * Fudan University(复旦大学) Ant Group(蚂蚁集团) Zhejiang University(浙江大学) Tsinghua University(清华大学)

专题命中 其他医学AI :medical AI(abstract)

AI总结 针对推理模型在信息不足时无法有效弃权的问题,提出Judge-Then-Solve(JTS)轨迹级推理控制框架,通过可回答性判断和强化学习训练,显著提升可靠弃权率并减少不必要的推理。

详情

展开后加载摘要…

URL PDF HTML 收藏