Decoding the Multimodal Mind: Generalizable Brain-to-Text Translation via Multimodal Alignment and Adaptive Routing
解码多模态思维:通过多模态对齐和自适应路由实现可泛化的脑到文本翻译
Chunyu Ye, Yunhao Zhang, Jingyuan Sun, Chong Li, Yang Zhao, Shaonan Wang
机构
*
State Key Laboratory of Multimodal Artificial Intelligence System, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Department of Computer Science, The University of Manchester(曼彻斯特大学计算机科学系)
;
Department of Language Science and Technology, Hong Kong Polytechnic University(香港理工大学语言科学与技术系)
机构
*
University of Hong Kong(香港大学)
;
ByteDance Seed(字节跳动种子)
;
The Chinese University of Hong Kong(香港中文大学)
;
Nanjing University(南京大学)
;
Tsinghua University(清华大学)
机构
*
Department of Computer Science, Southern Methodist University(计算机科学系,南方 Methodist 大学)
;
Department of Ophthalmology, UT Southwestern Medical Center(眼科学系,UT 南方医学中心)
;
High Performance Computing Program, National Aeronautics and Space Administration(高性能计算计划,国家航空航天局)
Towards Benign Memory Forgetting for Selective Multimodal Large Language Model Unlearning
面向选择性多模态大语言模型遗忘的良性记忆遗忘
Zhen Zeng, Leijiang Gu, Zhangling Duan, Feng Li, Cees G. M. Snoek, Meng Wang, Zenglin Shi
机构
*
Hefei University of Technology(合肥工业大学)
;
Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)
;
University of Amsterdam(阿姆斯特丹大学)
Bidirectional Cross-Attention Fusion of High-Resolution RGB and Low-Resolution Hyperspectral Inputs for Multimodal Semantic Segmentation
高分辨率RGB与低分辨率高光谱输入的双向交叉注意力融合用于多模态语义分割
Jonas V. Funk, Lukas Roming, Andreas Michel, Paul Bäcker, Georg Maier, Thomas Längle, Markus Klute
机构
*
KIT, Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)
;
Fraunhofer IOSB, Fraunhofer Institute of Optronics, System Technologies(弗劳恩霍夫院所光学、系统技术与图像利用研究所)
MACS: Modality-Aware Capacity Scaling for Efficient Multimodal MoE Inference
MACS: 模态感知容量缩放用于高效多模态MoE推理
Bo Li, Chuan Wu, Shaolin Zhu
机构
*
School of Software, Tsinghua University, Beijing, China(清华大学软件学院,北京,中国)
;
TJUNLP Lab, School of Computer Science and Technology, Tianjin University, China(天津大学计算机科学与技术学院,中国)
;
School of New Media and Communication, Tianjin University, China(天津大学新媒体与传播学院,中国)
TokaMind: A Multi-Modal Transformer Foundation Model for Tokamak Plasma Dynamics
TokaMind: 用于托卡马克等离子体动力学的多模态Transformer基础模型
Tobia Boschi, Andrea Loreti, Nicola C. Amorisco, Rodrigo H. Ordonez-Hurtado, Cécile Rousseau, George K. Holt, Eszter Székely, Alexander Whittle, Samuel Jackson, Adriano Agnello, Stanislas Pamela, Alessandra Pascale, Robert Akers, Juan Bernabe Moreno, Vassil Alexandrov, Mykhaylo Zayats
机构
*
IBM Research(IBM研究院)
;
UK Atomic Energy Authority(英国原子能局)
;
STFC Hartree Centre(科学与技术设施研究中心哈特ree中心)
机构
*
National University of Singapore(新加坡国立大学)
;
Ludwig Maximilian University of Munich(慕尼黑大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
Sun Yat-sen University(中山大学)
机构
*
Institute of Cyber-Systems and Control, Zhejiang University(浙江大学控制科学与工程学院)
;
School of Control Science and Engineering, Shandong University(山东大学控制科学与工程学院)
Multi-Representation Geometric Hierarchy Fusion: An Implicit-Submap Driven Framework for Resilient 3D Place Recognition
多表示几何层次融合:一种用于鲁棒三维地点识别的隐式子图驱动框架
Xiaohui Jiang, Haijiang Zhu, Chade Li, Ning An
机构
*
College of Information and Technology, Beijing University of Chemical Technology(信息与技术学院,北京化工大学)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)
;
Research Institute of Mine Artificial Intelligence, China Coal Research Institute(矿山人工智能研究院,中国煤炭科研院)