Comments46 pages, 2 figures. Paper IV in a series on branching transport networks, Supplemental Material available; see also arXiv:2603.13687 (Paper I), arXiv:2603.14691 (Paper II), and arXiv:2604.10476 (Paper III). Zenodo: https://doi.org/10.5281/zenodo.20030962
DFLOP: A Data-driven Framework for Multimodal LLM Training Pipeline Optimization
DFLOP: 一种基于数据的多模态大语言模型训练流水线优化框架
Hyeonjun An, Sihyun Kim, Chaerim Lim, Hyunjoon Kim, Rathijit Sen, Sangmin Jung, Hyeonsoo Lee, Dongwook Kim, Takki Yu, Jinkyu Jeong, Youngsok Kim, Kwanghyun Park
专题命中
VLM训练与架构
:multimodal large language model(abstract)
EmoS: A High-Fidelity Multimodal Benchmark for Fine-grained Streaming Emotional Understanding
EmoS:一种高保真多模态基准,用于细粒度流式情感理解
Pengze Guo, Jingxi Liang, Zhiwen Xie, Qifeng Wang, Derek F. Wong
机构
*
NLP(自然语言处理)
;
CT Lab, Department of Computer and Information Science, University of Macau(计算机与信息科学学院,澳门大学CT实验室)
;
School of Computer Science, Central China Normal University(Central China Normal University计算机科学学院)
专题命中
VLM训练与架构
:multimodal large language model(abstract)
Mind the Gap No More: Achieving Zero-Gap Multimodal Integration via One Tokenizer
不再有间隙:通过一个分词器实现零间隙多模态整合
Yanan Li, Christina Yi Jin, Yuan Jin, Manli Luo, Tie Xu, Shuai Jiao, Wei He, Qing Zhang
机构
*
Research Center for Frontier Fundamental Studies, Zhejiang Lab(前沿基础研究研究中心,浙江实验室)
;
Research Center for Scientific Data Hub, Zhejiang Lab(科学数据枢纽研究中心,浙江实验室)
专题命中
VLM训练与架构
:multimodal large language model(abstract)
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
China Academy of Information and Communications Technology, Artificial Intelligence Institute(信息与通信技术研究院,人工智能研究所)
Semantic Alignment Between Normative Theories of Ethics and the European Union Artificial Intelligence Act: A Transformer-Based Semantic Textual Similarity Analysis
KORE: Enhancing Knowledge Injection for Large Multimodal Models via Knowledge-Oriented Controls
KORE:通过知识导向控制增强大型多模态模型的知识注入
Kailin Jiang, Hongbo Jiang, Ning Jiang, Zhi Gao, Jinhe Bi, Yuchen Ren, Bin Li, Yuntao Du, Lei Liu, Qing Li
机构
*
University of Science
;
State Key Laboratory of General Artificial Intelligence, BIGAI
;
Xiamen University
;
Northeast Forestry University
;
Beijing Institute of Technology
;
Ludwig Maximilian University of Munich
;
The University of Sydney
;
C-FAIR\&school of software, Shandong University
;
State Key Lab. for Novel Software Technology, Nanjing University, P.R. China
CausalEmbed: Auto-Regressive Multi-Vector Generation in Latent Space for Visual Document Embedding
CausalEmbed: 在潜在空间中实现自动回归多向量生成用于视觉文档嵌入
Jiahao Huo, Yu Huang, Yibo Yan, Ye Pan, Kening Zheng, Wei-Chieh Huang, Yi Cao, Mingdong Ou, Philip S. Yu, Xuming Hu
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Alibaba Cloud Computing(阿里云计算)
;
University of Illinois Chicago(伊利诺伊大学芝加哥分校)
专题命中
VLM训练与架构
:multimodal large language model(abstract)
MCAT: Scaling Many-to-Many Speech-to-Text Translation with MLLMs to 70 Languages
MCAT: 通过MLLMs扩展多对多语音到文本翻译至70种语言
Yexing Du, Kaiyuan Liu, Youcheng Pan, Bo Yang, Keqi Deng, Xie Chen, Yang Xiang, Ming Liu, Bing Qin, YaoWei Wang
机构
*
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
Pengcheng Laboratory(鹏城实验室)
;
Harbin Institute of Technology, Harbin(哈尔滨工业大学(哈尔滨))
;
University of Cambridge(剑桥大学)
;
Shanghai Jiao Tong University(上海交通大学)
专题命中
VLM训练与架构
:multimodal large language model(abstract)
机构
*
College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与技术学院)
;
College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院)
;
Jiiov Technology(极奥科技)
专题命中
VLM训练与架构
:multimodal large language model(abstract)
Eunbi Choi, Kibong Choi, Sehyun Chun, Seokhee Hong, Junwon Hwang, Hyojin Jeon, Ahra Jo, Hyunjik Jo, Yeonsik Jo, Joonkee Kim, Seonghwan Kim, Soyeon Kim, Sunkyoung Kim, Yireun Kim, Yongil Kim, Changhun Lee, Haeju Lee, Jinsik Lee, Kyungmin Lee, Sangha Park, Kwangrok Ryoo, Minju Seo, Sejong Yang, Heuiyeen Yeen, Hwan Chang, Stanley Jungkyu Choi, Yejin Choi, Kyubeen Han, Joonwon Jang, Kijeong Jeon, Geunyeong Jeong, Gerrard Jeongwon Jo, Jiyeon Jung, Daeseong Kim, Dohoon Kim, Dohyun Kim, Hyunseo Kim, Minu Kim, Myoungshin Kim, Youchul Kim, Byungoh Ko, Christopher Lee, Edward Hwayoung Lee, Honglak Lee, Jiyoung Lee, Sangeun Lee, Seungwon Lim, Woohyung Lim, Jueun Mun, Jaewoo Park, Jimin Park, Jinho Park, Yongmin Park, Wooseok Seo, Yongwoo Song, Sihyuk Yi, Kyungjae Yoo, Sangyeon Yoon