2607.23886 2026-08-03 cond-mat.mtrl-sci cs.AI cs.CL cs.DL cs.IR 版本更新 81% Harnessing X-ray Absorption Spectroscopy Data through Multimodal Mining of Battery Literature 通过电池文献的多模态挖掘利用X射线吸收光谱数据 Tanjin He, Aikaterini Vriza, Logan Ward, Xu Huang, Yiming Chen, Anubhav Jain, Gerbrand Ceder, Rajeev S. Assary, Ian T. Foster, Maria K. Y. Chan 专题命中 多模态评测 :multimodal(title,abstract);分类 cs.CL、cs.AI AI总结 研究利用多模态文献挖掘将电池文献中分散的X射线吸收光谱数据转化为可用于人工智能的实验数据资源,开发数字化管道并应用于电池文献,产生开放数据集,为相关分析、比较及材料发现提供基础。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2607.29624 2026-08-03 cs.CY cs.AI cs.HC 新提交 79% The Theoretical Foundation of Socratic Tests: Dynamic, Multimodal, Conversational Examinations 苏格拉底测试的理论基础:动态、多模态、对话式考试 Ilya Mikhelson 专题命中 多模态评测 :multimodal(title,abstract);分类 cs.AI AI总结 本文提出苏格拉底测试的理论基础,整合多类教育评估原则与分类学,量化最近发展区并设计非补偿性加法评分架构,以解决传统评估的缺陷并提升测量可靠性。 Comments 21 pages, 1 figure, submitted to Computers and Education: Artificial Intelligence 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2607.29039 2026-08-03 cs.CV 新提交 79% ReMoE: Report-Guided Mixture-of-Experts for Multimodal OCT/OCTA Anomaly Detection ReMoE:报告引导型混合专家模型用于多模态OCT/OCTA异常检测 Zihan Nie, Qincheng Qiao, Muhao Xu, Wei Feng, Xinguo Hou, Weiye Song, Zongyuan Ge 专题命中 多模态评测 :multimodal(title,abstract);分类 cs.CV AI总结 针对多模态OCT/OCTA异常检测,提出ReMoE模型,融合正常报告语义构建模态感知先验,在两个数据集上取得最优性能。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2607.29002 2026-08-03 cs.AI 新提交 79% MMShopBench: A Real-Log Benchmark for Multimodal, Multi-Turn Shopping Agents MMShopBench:面向多模态多轮购物智能体的真实日志基准 Zeying Hao, Hao Guo, Mengtao Xu, Yimin Hu, Yuheng Song, Zesheng Zhou, Jinsong Lan, Xiaoyong Zhu 专题命中 多模态评测 :multimodal(title,abstract);分类 cs.AI AI总结 该研究推出首个多模态多轮购物智能体真实日志基准MMShopBench,构建离线购物沙箱,经微调后开源模型性能大幅接近领先专有模型,验证了基准及配套训练数据的有效性。 Comments 16 pages, 6 figures, including appendix 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2607.28991 2026-08-03 cs.CV 新提交 79% CAER: Conflict-Aware Evidence Routing with Dual Prefix Experts for Multimodal Large Language Models CAER:面向多模态大语言模型的冲突感知证据路由,采用双前缀专家机制 Zixuan Liu, Juntao Cai, Xiaoxu Cai, Haishuai Wang, Jiajun Bu 专题命中 多模态评测 :multimodal(title,abstract);分类 cs.CV AI总结 本研究提出与主干无关的CAER框架,通过双前缀专家路由机制实现视觉-语言冲突检测与冲突感知生成,在MMMC及AgriConflict数据集上验证可提升开源多模态大语言模型的可靠性。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2607.29222 2026-08-03 cs.CV 新提交 77% Is It Time for the Renaissance of Salient Object Detection in the Era of MLLMs? 多模态大语言模型(MLLMs)时代,显著性目标检测的复兴时机已到? Wenzhuo Zhao, Xiuzhi Li, Zhongkuan Mao, Ronghao Xian, Yao Jiang, Zhao Gao, Keren Fu, Qijun Zhao, Jian Cheng 专题命中 多模态评测 :MLLM(abstract,abstract_cn);multimodal(abstract);分类 cs.CV AI总结 该研究针对MLLMs时代SOD的能力不匹配问题,提出无训练框架FOCUS,在13类SOD基准上超越SOTA方法,推动SOD从特定任务监督转向零样本前景组织。 Comments 10 pages, 4 figures, conference 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2601.02854 2026-08-03 cs.AI 版本更新 70% M3MAD-Bench: Multi-Dimensional Evaluation of Multi-Agent Debate Across Domains and Modalities M3MAD-Bench: 多智能体辩论在不同领域和模态中真的有效吗? Ao Li, Jinghui Zhang, Luyu Li, Yuxiang Duan, Lang Gao, Mingcai Chen, Weijun Qin, Shaopeng Li, Fengxian Ji, Ning Liu, Lizhen Cui, Xiuying Chen, Yuntao Du 机构 * Shandong University(山东大学) ; MBZUAI ; Nanjing University of Posts and Telecommunications(南京邮电大学) ; BOB Cloud(BOB云) 纠错 专题命中 多模态评测 :multimodal(abstract);multi-modal(abstract);分类 cs.AI AI总结 M3MAD-Bench通过多领域、多模态和多维指标评估多智能体辩论方法的有效性,提供全面的性能-成本分析。 Comments Accepted by ACMMM 2026 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2607.29124 2026-08-03 cs.CV cs.LG 新提交 57% SciFigPlag-Bench: A Benchmark for Provenance-Aware Scientific Figure Plagiarism Detection SciFigPlag-Bench:面向来源感知的科学图片抄袭检测基准 Zhiying Cui, Minghao Yang, Linlin Gao, Jie Liu, Pengyuan Li 专题命中 多模态评测 :multimodal(abstract);分类 cs.CV AI总结 本文提出SciFigPlag-Bench基准,用于科学图片的来源感知抄袭检测,含四类任务,实验发现视觉语言模型在细粒度来源推理等方面仍有挑战。 Comments 30 pages, 18 figures 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2607.28645 2026-08-03 cs.HC cs.AI 新提交 57% Looks Right, Works Right: A Project-Level Benchmark for Multi-Screen Mobile App Generation 看起来对,运行起来对:面向多屏移动应用生成的项目级基准测试 Fan Wu, Cuiyun Gao, Yiming Huang, Yang Xiao, Yujia Chen, Qing Liao 专题命中 多模态评测 :multimodal(abstract);分类 cs.AI AI总结 针对现有设计转代码基准的局限,提出首个项目级多屏移动应用生成基准MobileForge,通过五轴评估及两种测试方法,发现前沿多模态LLM构建的应用存在导航、保真度和可维护性问题。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2607.18529 2026-08-03 cs.HC cs.AI 版本更新 57% EduPanel: A Three-Agent LLM Judge for Teaching Videos -- Reliability, Complementarity, and Human Trust Calibration EduPanel:用于教学视频的三智能体大语言模型评判器——可靠性、互补性和人类信任校准 Jia-Kai Dong, Yi-Cheng Lin, Hung-yi Lee 机构 * National Taiwan University(国立台湾大学) ; NTU Artificial Intelligence Center of Research Excellence(NTU人工智能卓越研究中心) 纠错 专题命中 多模态评测 :multimodal(abstract);分类 cs.AI AI总结 针对教学视频教学质量评估需求,提出基于评分标准、以学习者为条件的EduPanel大语言模型评判器,通过专门智能体分解评估,经多项分析实现高可靠性,能辅助教育评估,提高评分准确性且让专家可检测不可靠输出。 Comments 19 pages 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2607.29090 2026-08-03 cs.LG 新提交 50% What Is Missing in Surgical Risk Stratification and Outcome Prediction: A Scoping Review of End-to-End Machine Learning Approaches 手术风险分层与结局预测中缺失的内容:端到端机器学习方法的范围综述 Yizhi Dong, Yuhe Ke, Hairil Rizal Abdullah, Yucheng Xing, Kevan Kai Bing Teo, Ling Huang, Mengling Feng 专题命中 多模态评测 :multimodal(abstract) AI总结 本范围综述回顾190项研究,分析手术风险分层与结局预测的ML流程,发现数据、方法、评估等方面存在差距,为开发更严谨的围手术期ML工具提供参考。 Comments This work has been submitted to the IEEE JBHI for possible publication. Copyright may be transferred without notice, after which this version may no longer be accessible 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2602.08913 2026-08-03 cs.LG stat.ML 版本更新 50% GEMSS: A Variational Method for Discovering Multiple Sparse Solutions in Classification and Regression Problems GEMSS: 一种用于在分类和回归问题中发现多个稀疏解的变分贝叶斯方法 Kateřina Henclová, Václav Šmídl 机构 * Faculty of Electrical Engineering, Czech Technical University(捷克技术大学电子工程系) 纠错 专题命中 多模态评测 :multimodal(abstract) AI总结 提出GEMSS算法,利用结构化spike-and-slab先验、高斯混合近似后验和Jaccard惩罚,通过变分推断同时发现多个多样化的稀疏特征组合,在128个实验和3个真实数据集上优于对比方法。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图