Diverse via bounded Agreement: Geometric Regularization for Multimodal Fusion
通过有界一致性实现多样性:多模态融合的几何正则化
Zixuan Xia, Hao Wang, Pengcheng Weng, Yanyu Qian, Yangxin Xu, William Dan, Fei Wang
机构
*
Department of Informatics University of Bern(伯尔尼大学信息学院)
;
College of Computing and Data Science Nanyang Technological University(南洋理工大学计算机与数据科学学院)
;
School of Software Engineering Xi’an Jiaotong University(西安交通大学软件工程学院)
CACARA: Cross-Modal Alignment Leveraging a Text-Centric Approach for Cost-Effective Multimodal and Multilingual Learning
CACARA:基于文本中心方法的跨模态对齐,用于高效多模态和多语言学习
Diego A. B. Moreira, Alef I. Ferreira, Jhessica Silva, Gabriel O. dos Santos, Gustavo Bonil, João Gondim, Marina dos Santos, Helena Maia, Simone Hashiguti, Nádia da Silva, Carolina Scarton, Helio Pedrini, Sandra Avila
机构
*
Instituto de Computação, Universidade Estadual de Campinas (UNICAMP), Brasil(计算机学院,Campinas州立大学(UNICAMP))
;
Instituto de Estudos da Linguagem, Universidade Estadual de Campinas (UNICAMP), Brasil(语言研究学院,Campinas州立大学(UNICAMP))
;
Instituto de Informática, Universidade Federal de Goiás (UFG), Goiás, Brasil(信息学院,戈亚斯联邦大学(UFG))
;
Department of Computer Science, University of Sheffield, Sheffield, United Kingdom(计算机科学系,谢菲尔德大学)
A Unified Multi-Modal Framework for Intelligent Financial Systems: Integrating Reinforcement Learning, High-Frequency Trading, and Game-Theoretic Approaches with Cross-Modal Sentiment Analysis
面向智能金融系统的统一多模态框架:整合强化学习、高频交易和博弈论方法与跨模态情感分析
Fanrong Liu, Zhang Yuwei, Mingni Luo
机构
*
Henan University, International Eurasia College(河南大学,国际欧亚学院)
;
City University of Hong Kong, College of Business(香港城市大学,商学院)
;
Northeastern University, School of Electronic and Information Engineering(东北大学,电子与信息工程学院)
Zatom-1: Towards a Multimodal Foundation Model for 3D Molecules and Materials
Zatom-1:迈向3D分子和材料的多模态基础模型
Alex Morehead, Miruna Cretu, Antonia Panescu, Rishabh Anand, Maurice Weiler, Tynan Perez, Samuel Blau, Steven Farrell, Wahid Bhimji, Anubhav Jain, Hrushikesh Sahasrabuddhe, Pietro Lio, Tommi Jaakkola, Rafael Gomez-Bombarelli, Rex Ying, N. Benjamin Erichson, Michael W. Mahoney
机构
*
LBNL(劳伦斯伯克利国家实验室)
;
ICSI(国际计算机科学研究所)
;
University of Cambridge(剑桥大学)
;
Yale University(耶鲁大学)
;
MIT(麻省理工学院)
;
UC Berkeley(加州大学伯克利分校)
专题命中
多模态训练与对齐
:multimodal(title,abstract);multimodal foundation model(title);分类 cs.AI
ViTaPEs: Visuotactile Position Encodings for Cross-Modal Alignment in Multimodal Transformers
ViTaPEs: 视觉触觉位置编码用于多模态转换器中的跨模态对齐
Fotios Lygerakis, Ozan Özdenizci, Elmar Rückert
机构
*
Chair of Cyber-Physical Systems(感知系统教授席位)
;
Institute of Machine Learning and Neural Computation(机器学习与神经计算研究所)
;
Technical University of Leoben(莱比锡技术大学)
;
Graz University of Technology(格拉茨技术大学)