Multimodal diff-hash
专题命中 其他多模态 :multimodal(title,abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 其他多模态 :multimodal(title,abstract);分类 cs.CV
专题命中 其他多模态 :multi-modal(title);multimodal(abstract);分类 cs.AI
专题命中 其他多模态 :multimodal(title,abstract);分类 cs.AI
Comments ii + 30 pages
所有重子五夸克的多模碎片化:用于强子对撞机的不确定性感知预测
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 本文提出考虑不确定性的主导功率碎片化描述,用于研究强子对撞机中所有charm五夸克态的碎片化,构建多模碎片函数集PQ5Q1.1,结合微扰与非微扰不确定性,优化初始尺度输入以描述多夸克和双夸克产生机制,并应用于HL-LHC及未来FCC。
Comments 51 pages, 9 figures, 1 table, 264 references, version published in Phys. Rev. D. One novel set of multimodal (direct multicharm and diquark-like initial-scale inputs) PQ5Q1.1 NLO collinear fragmentation functions. Includes F-MHOU and F-NPWF uncertainty replicas, threshold-aware HF-NRevo DGLAP evolution, and LHAPDF release at https://github.com/FGCeliberto/Collinear_FFs
专题命中 其他多模态 :multimodal(title,abstract)
Comments It integrates artificial intelligence, multimodal cognitive modeling, political behavior simulation, and data visualization, making it an interdisciplinary AI-based modeling study
专题命中 其他多模态 :multi-modal(title,abstract);multimodal(comments)
Comments 15 pages, 1 figure, 16 tables. Submitted for GECCO 2024 competition on Benchmarking Niching Methods for Multimodal Optimization
专题命中 其他多模态 :multimodal(title,abstract)
Comments submitted to PPSN'14 Workshop Advances in Multimodal Optimization
专题命中 其他多模态 :multimodal(title,abstract)
Journal ref X.-S. Yang, Firefly algorithms for multimodal optimization, in: Stochastic Algorithms: Foundations and Applications, SAGA 2009, Lecture Notes in Computer Sciences, Vol. 5792, pp. 169-178 (2009).
专题命中 其他多模态 :multimodal(title,abstract)
Comments Describes framework and software architecture for multimodal web interaction management
EVE: 通过可执行视觉变换实现多模态大语言模型的可验证自进化
机构 * National Engineering Research Center for Software Engineering, Peking University(软件工程国家级工程研究中心,北京大学) ; School of Control Science and Engineering, Shandong University(控制科学与工程学院,山东大学)
专题命中 其他多模态 :MLLM(abstract,abstract_cn);multimodal(abstract);分类 cs.CV、cs.AI
AI总结 本文提出EVE框架,通过可执行视觉变换实现多模态大语言模型的可验证自进化,解决伪标签方法和模板方法的不足,通过双策略架构和多维奖励系统提升模型自进化能力。
V-Reflection:将多模态大语言模型从被动观察者转变为主动提问者
机构 * AI Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)人工智能方向) ; International Digital Economy Academy(国际数字经济学院) ; MedVisAI Lab, Lee Kong Chian School of Medicine, Nanyang Technological University, and Centre of AI in Medicine(医学视觉人工智能实验室,南洋理工大学Lee Kong Chian医学院,以及人工智能在医学中的中心) ; South China University of Technology(华南理工大学) ; Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University(香港理工大学电子与电气工程系)
专题命中 其他多模态 :MLLM(abstract,abstract_cn);multimodal(abstract);分类 cs.CV、cs.AI
AI总结 本文提出V-Reflection框架,通过'思考后再观察'的视觉反思机制,使多模态大语言模型能主动提问视觉特征空间,提升细粒度任务的感知能力。
Comments Main paper 14 pages with supplementary 7 pages
专题命中 其他多模态 :multimodal(abstract);multi-modal(abstract);cross-modal(abstract);分类 cs.CV、cs.CL
PathFinder:链接多模态数据集的联合分解方法
机构 * Oxford Centre for Integrative Neuroimaging(牛津整合神经成像中心) ; University of Oxford(牛津大学)
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 PathFinder是一种通用的联合矩阵分解框架,可分析未必共享同一维度的多模态数据集,能发现跨模态等的共同模式并预测缺失数据。
带完整公式的多模态逻辑程序设计
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 本文提出一阶多模态逻辑程序设计系统MMLP,其支持任意公式作为程序与查询,基于带模态原理的希尔伯特系统给出声明语义,采用嵌套证明演算,合一算法控制特征参数作用域,性能优于相关系统。
定量多模态光学相干光声弹性成像
专题命中 其他多模态 :multi-modal(title,abstract)
AI总结 提出结合光学相干断层扫描(OCT)和光声断层扫描(PAT)的多模态弹性成像框架,通过混合反演算法融合互补信息,在硅胶体模上实现更高信噪比和更准确的刚度估计。
Comments 10 pages, 10 figures, 2 tables
专题命中 其他多模态 :multimodal(title,abstract)
Comments 9 pages, 3 figures, accepted by IEEE FIE 2025
针对模态缺失的多模态回归的共形校准
专题命中 其他多模态 :multi-modal(title,abstract)
AI总结 针对多模态回归中模态缺失或分歧导致预测区间难校准的问题,提出感知模态的共形校准层,在多组实验中提升了区间性能,尤其在模态缺失时恢复了覆盖率。
Comments Published at the Symposium on Conformal and Probabilistic Prediction with Applications (COPA 2026)
预测Mg/LPSO两相合金应变局域化的多模态深度学习框架
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 本研究采用多模态深度学习框架,结合三种微观结构描述符,从三维图像预测Mg/LPSO两相合金的压缩局域应变分布,验证了方法的有效性。
Comments Published in Acta Materialia, Volume 281, 120398 (2024)
Journal ref Acta Materialia 281 (2024) 120398
面向非线性与多模态状态估计的自适应拆分-合并高斯混合滤波器
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 本文针对非线性多模态状态估计问题,提出自适应拆分-合并高斯混合滤波器(AMF),通过拆分合并高斯粒子实现高效准确的PDF估计,在多基准测试中性能优于基线滤波器,还提出了其并行实现方案。
Comments 60 pages, 13 figures
Hoverflie:对转子导流罩将微型飞行器转变为多模式气垫船的实验研究
机构 * University of Hawaii at Manoa(夏威夷大学马诺阿分校)
专题命中 其他多模态 :multi-modal(title,abstract)
AI总结 本研究通过设计定制转子导流罩系统,将Crazyflie 2.1微型飞行器转变为多模式机器人,开发经验模型优化导流罩配置,提升了地面效应性能并延长了续航时间,为相关后续研究提供了基础。
用于多模态行星防御的小行星破坏与偏转模拟
专题命中 其他多模态 :multi-modal(title,abstract)
AI总结 该研究针对小行星行星防御的终端场景问题,采用PI方法结合ALE3D模拟,证实20-100米级碎石堆小行星可通过特定参数的超高速钨侵彻体撞击有效减缓,为多模态行星防御提供可行方案。
Comments 9 pages, 8 figures
Journal ref Acta Astronautica, Volume 225, December 2024, Pages 960-967
AutoCue:多模态大语言模型辅助将隐式输入外部化为录屏教程中的教学视觉提示
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 AutoCue是多模态大语言模型辅助的教程增强流水线,可将录屏教程中隐式输入外部化为视觉提示,在Autodesk Maya上的评估显示其能缩短任务时间、减少交互中断并提升学习者体验
Comments Accepted to Graphics Interface 2026 (GI 2026)
沉浸式计算笔记本中跨多模态制品的组织策略理解
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 本研究针对沉浸式计算笔记本(ICoN)中多模态制品的组织策略开展用户研究,发现参与者主要采用基于深度的布局,空间组织围绕基于单元的制品构建,弥补了该领域多模态组织策略研究的不足。
专题命中 其他多模态 :multimodal(title,abstract)
FedOGL:联邦开放世界多模态图学习中灾难性遗忘的应对
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 针对联邦开放世界多模态图学习的灾难性遗忘问题,本文提出FedOGL框架,通过客户端记忆保留与服务器原型共享,使性能下降降低42.67%,同时维持或提升下游任务性能。
Comments 8 pages, 7 figures
古代生物技术衍生金属盐中痕量元素分布与矿物相的匹配:多模态分析
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 本文针对古代金属盐痕量元素空间分布研究的不足,提出整合空间分辨XRF、XRD和纳米级X射线成像的多模态方法,实现了痕量元素与矿物相的可靠匹配,可用于追踪文物化学组成变化。
多模态数据理解:理解视觉-文本信息链如何影响数据解释
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 研究多模态数据理解中视觉与文本信息链对数据解释的影响,提出用可视化优先链和文本优先链呈现信息的实验范式,通过比较发现不同链的理解特点,为多模态信息整合及有效数据通信设计提供见解。
基于小冲孔试验多模态测量估计材料本构参数的摊销后验
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 研究从小冲孔试验多模态测量估计材料本构参数问题,提出将高斯过程代理与条件流匹配相结合的摊销无似然框架,避免手工似然和重复采样,通过实验证明该方法能有效收缩后验,建立了强大的无似然推断框架。
用于多模态量子材料表征的代工CMOS平台
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 研究利用65纳米CMOS工艺,通过功能划分金属堆栈构建多模态量子材料表征平台,可进行低温磁化率测量、NV中心光探测磁共振,降低功率需求且兼容原位电子束成像,建立了可扩展、可代工制造的平台。
在虚拟现实学习环境中使用多模态数据评估学习过程
专题命中 其他多模态 :multimodal(title,abstract)
AI总结 研究如何在VR学习环境中用多模态数据评估学习过程,通过探索VR密室逃脱游戏的多模态数据源,利用VR特性促进多模态交互,以了解数据对参与者推理技能与猜测行为的揭示情况。
Journal ref Proceedings of the 20th International Conference of the Learning Sciences. ICLS 2026. Irvine, CA, USA. 1807-1811