机构
*
Department of Computer Science, George Mason University(计算机科学系,乔治·马歇尔大学)
;
Department of Engineering Science, University of South Florida(工程科学系,佛罗里达州立大学)
;
Department of Computer Science, Rutgers University(计算机科学系,罗格斯大学)
Ye Yuan, Kehan Chen, Xinqiang Yu, Wentao Xu, Heng Wang, Libo Huang, Chuanguang Yang, Yan Huang, Jiawei He, Zhulin An
机构
*
School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所人工智能安全国家重点实验室)
;
National Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
XYZ Embodied AI(XYZ具身人工智能)
Maijunxian Wang, Yijiang Li, Bingyang Wang, Tianwei Zhao, Ran Ji, Qingying Gao, Emmy Liu, Hokin Deng, Dezhi Luo
机构
*
Cognitive Science Program, University of California, Berkeley(加州大学伯克利分校认知科学项目)
;
Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电气与计算机工程系)
;
School of Computer Science, Georgia Institute of Technology & Emory University(佐治亚理工学院计算机科学学院及埃默里大学)
;
Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系)
;
Department of Cognitive Science, University of California San Diego(加州大学圣地亚哥分校认知科学系)
;
Equal Advising Department of Computer Science & Wilmer Eye Institute, Johns Hopkins University(约翰霍普金斯大学计算机科学系及威尔默眼科研究所)
;
Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所)
;
Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)
;
Weinberg Institute for Cognitive Science, University of Michigan(密歇根大学韦恩伯格认知科学研究所)
Continual Learning with Elastic Regularization and Synthetic Replay for Federated MLLM Fine-Tuning
用于联邦多模态大语言模型微调的弹性正则化和合成重放持续学习
Jing Liu, Chenxuanyin Zou, Jiayang Ren, Gaoyun Fang, Chengfang Li, Yan Wang, Zhenchao Ma, Bo Hu
机构
*
The University of British Columbia(英属哥伦比亚大学)
;
Fudan University(复旦大学)
;
Royal College of Science, Imperial College London(伦敦帝国理工学院皇家科学学院)
;
Dyson School of Design Engineering(戴森设计工程学院)
;
Suzhou Institute of Biomedical Engineering and Technology (SIBET), Chinese Academy of Sciences(中国科学院苏州生物医学工程技术研究所)
;
East China Normal University(华东师范大学)
专题命中
VLM训练与架构
:MLLM(title,abstract_cn);multimodal large language model(abstract);分类 cs.CV、cs.AI、cs.LG
Lost in Visual Translation: A VLM-Assisted Perceptual-Semantic Coherence Framework for EEG-to-Image Reconstruction
迷失在视觉翻译中:用于脑电到图像重建的基于视觉语言模型的感知语义连贯框架
Sukriti Tiwari, BHVSP Subrahmanyam, Nidhi Goyal, Sai Amrit Patnaik
机构
*
Mahindra University(马欣德拉大学)
;
MU-VT Interdisciplinary Advanced Research Centre for Transformative Technologies, Mahindra University(马欣德拉大学MU-VT变革性技术跨学科高级研究中心)
PFAdapter: Hierarchical LoRA Decomposition for Personalized Federated MLLMs
PFAdapter:用于个性化联邦多模态大语言模型的分层LoRA分解
Jing Liu, Kun Yang, Yan Wang, Dingkang Yang, Xiaoshuai Hao, Wei Zhang, Yang Liu, Wei Zhou
机构
*
College of Future Information Technology, Fudan University(复旦大学未来信息技术学院)
;
Division of Natural and Applied Sciences, Duke Kunshan University(昆山杜克大学自然科学与应用科学部)
;
Department of Electrical and Computer Engineering, The University of British Columbia(英属哥伦比亚大学电气与计算机工程系)
;
Ant Group(蚂蚁集团)
;
College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院)
;
School of Data Science and Engineering, East China Normal University(华东师范大学数据科学与工程学院)
;
College of Intelligent Robotics and Advanced Manufacturing, Fudan University & Fysics AI(复旦大学智能机器人与先进制造学院及复肆智能科技(上海)有限公司)
;
Xiaomi EV, Xiaomi Campus(小米汽车、小米园区)
;
Information and Communications Technology Cluster, Singapore Institute of Technology (SIT)(新加坡理工学院信息通信技术集群)
;
College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院)
;
School of Computer Science and Informatics, Cardiff University(卡迪夫大学计算机科学与信息学院)
专题命中
VLM训练与架构
:multimodal large language model(abstract);分类 cs.AI、cs.LG
Gaussian Mixture Modeling for Event-Aware Visual Allocation in Long Video Understanding
用于长视频理解中事件感知视觉分配的高斯混合模型
Yifan Lu, Ziqi Zhang, Chunfeng Yuan, Jun Gao, Bing Li, Weiming Hu
机构
*
Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information, CASIA(中国科学院自动化所多模态信息超智能安全北京市重点实验室)
;
State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(中国科学院自动化所多模态人工智能系统国家重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Hello Group(未知(保留英文))
;
School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)