Cross-modal Affinity-aligned Multimodal Learning Analytics for Predicting Student Collaboration Satisfaction in Game-Based Learning
跨模态亲和对齐的多模态学习分析用于预测基于游戏的学习中学生协作满意度
Wen-Hsin Tsai, Chia-Ming Lee, Yuk-Ying Tung
机构
*
Institute of Education, National Cheng Kung University(国立成功大学教育研究所)
;
Institute of Intelligent System, National Yang Ming Chiao Tung University(阳明交通大学智能系统研究所)
;
Department of Computer Science, University at Albany, State University of New York(纽约州立大学水牛城分校计算机科学系)
机构
*
Qingdao Institute of Software, College of Computer Science and Technology, China University of Petroleum (East China)(青岛软件研究所,计算机科学与技术学院,中国石油大学(华东))
;
Shandong Key Laboratory of Intelligent Oil & Gas Industrial Software(山东省智能油气工业软件重点实验室)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
How Many Visual Tokens Do Multimodal Language Models Need? Scaling Visual Token Pruning with F^3A
多模态语言模型需要多少视觉标记?通过F^3A进行视觉标记剪枝的扩展
YiJie Huang, Yiqun Zhang, Zhuoyue Jia, Xiaocui Yang, Junzhao Huang, Zihan Wang, Shi Feng, Daling Wang, Yifei Zhang, Yongkang Liu
机构
*
School of Computer Science and Engineering, Northeastern University, Shenyang 110819, China(东北大学计算机科学与工程学院,沈阳 110819,中国)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
School of Computer and Communication Engineering, Northeastern University, Qinhuangdao 066004, China(东北大学计算机与通信工程学院,秦皇岛 066004,中国)
SkyNative: A Native Multimodal Framework for Remote Sensing Visual Evidence Reasoning
SkyNative: 一种面向遥感视觉证据推理的原生多模态框架
Xiao Yang, Ronghao Fu, Zhiwen Lin, Zhuoran Duan, Jiashun Zhu, Jiasen Hu, Lang Sun, Weipeng Zhang, Jiaqi Liu, Xu Na, Haoran Liu, Weijie Zhang, Bo Yang
机构
*
College of Computer Science and Technology, Jilin University, China(吉林大学计算机科学与技术学院)
;
Key Laboratory of Symbolic Computation and Knowledge Engineering of Ministry of Education(教育部符号计算与知识工程重点实验室)
Robust Multimodal Representation Learning in Healthcare
医疗领域鲁棒多模态表征学习
Xiaoguang Zhu, Linxiao Gong, Lianlong Sun, Yang Liu, Haoyu Wang, Jing Liu
机构
*
University of California, Davis(加州大学戴维斯分校)
;
HKUST (GZ)(香港科技大学)
;
University of Rochester(罗切斯特大学)
;
Tongji University(同济大学)
;
Georgia Institute of Technology(佐治亚理工学院)
;
Fudan University(复旦大学)
;
The University of British Columbia(不列颠哥伦比亚大学)
Evaluating Cognitive Age Alignment in Interactive AI Agents
评估交互式AI代理的认知年龄对齐
Yifan Shen, Jiawen Zhang, Jian Xu, Junho Kim, Ismini Lourentzou, Xu Cao, Meihuan Huang
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Shenzhen Children's Hospital(深圳儿童医院)
;
Peking University(北京大学)
;
Hong Kong Polytechnic University(香港理工大学)
Rethinking Point Clouds as Sequences: A Causal Next-Token Predictive Learning Framework
重新思考点云作为序列:一种因果性下一标记预测学习框架
Yumeng Yao, Jingzhi Dong, Haowen Gu, Tao Chen, Zonghan Wu, Xiaoshui Huang, Yazhou Yao
机构
*
Nanjing University of Science and Technology(南京理工大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Hangzhou City University(杭州城市学院)
;
East China Normal University(华东师范大学)
专题命中
多模态训练与对齐
:multimodal(abstract);multimodal foundation model(abstract);分类 cs.CV
机构
*
Peking University(北京大学)
;
MIT(麻省理工学院)
;
TUM(技术大学(TUM))
;
Meituan(美团)
;
Peking University School of CIT, MCML, MDSIEECS and CSAIL(北京大学计算机学院、MCML、MDSIEECS以及CSAIL)
Neural Visual Decoding via Cognitive guided Adaptive Blurring and Information Constrained Alignment
通过认知引导的自适应模糊和信息受限对齐实现神经视觉解码
Fan Yin, Chuhang Zheng, Peiliang Gong, Donghai Guan, Qi Zhu
机构
*
Department of Artificial Intelligence, Nanjing University of Aeronautics and Astronautics(南京航空航天大学人工智能学院)
;
Department of Electrical and Information Engineering, Tianjin University(天津大学电气与信息工程学院)
机构
*
School of Artificial Intelligence, Xidian University(西安电子科技大学人工智能学院)
;
Zhongguancun Academy(中关村学院)
;
School of Automation, Beijing Institute of Technology(北京理工大学自动化学院)
SHED: Style-Homogenized Embedding Alignment for Domain Generalization
SHED: 风格均质化嵌入对齐用于领域泛化
Kai Gan, Tong Wei
机构
*
School of Computer Science and Engineering, Southeast University, Nanjing 210096, China(1 东南大学计算机科学与工程学院,南京 210096,中国)
;
Key Laboratory of Computer Network and Information Integration (Southeast University), Ministry of Education, China(2 教育部计算机网络与信息集成重点实验室(东南大学),中国)
Axial-Relation Guided Fusion State Space Model for Optical-Elevation Sensing Image Segmentation
基于轴向关系引导的融合状态空间模型用于光学-海拔感测图像分割
Feng Gao, Zhilin Jin, Yanhai Gan, Junyu Dong, Qian Du
机构
*
State Key Laboratory of Physical Oceanography, Ocean University of China(中国海洋大学物理海洋学国家重点实验室)
;
Department of Electrical and Computer Engineering, Mississippi State University(密苏里州立大学电气与计算机工程系)
机构
*
School of Computer Science and Technique(计算机科学与技术学院)
;
Tongji University(同济大学)
;
School of Communications and Electronic Engineering(通讯与电子工程学院)
;
East China Normal University(华东师范大学)
Machine Learning Enabled Graph Analysis of Particulate Composites: Application to Solid-state Battery Cathodes
机器学习赋能的颗粒复合材料分析:应用于固态电池正极
Zebin Li, Shimao Deng, Yijin Liu, Jia-Mian Hu
机构
*
Department of Materials Science and Engineering, University of Wisconsin-Madison(威斯康星大学麦迪逊分校材料科学与工程系)
;
Walker Department of Mechanical Engineering, University of Texas at Austin(德克萨斯大学奥斯汀分校沃克机械工程系)