Is One Layer Enough? Understanding Inference Dynamics in Tabular Foundation Models
一层够吗?理解表格基础模型的推理动态
Amir Rezaei Balef, Mykhailo Koshil, Katharina Eggensperger
机构
*
TU Dortmund University(杜伊斯堡-埃森大学)
;
Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔人工智能与机器学习研究所)
;
University of Tübingen(图宾根大学)
机构
*
Fudan University(复旦大学)
;
Tongji University(同济大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
The University of Hong Kong(香港大学)
;
University of California San Diego(加州大学圣地亚哥分校)
;
Nanjing University of Posts and Telecommunications(南京邮电大学)
KORE: Enhancing Knowledge Injection for Large Multimodal Models via Knowledge-Oriented Controls
KORE:通过知识导向控制增强大型多模态模型的知识注入
Kailin Jiang, Hongbo Jiang, Ning Jiang, Zhi Gao, Jinhe Bi, Yuchen Ren, Bin Li, Yuntao Du, Lei Liu, Qing Li
机构
*
University of Science
;
State Key Laboratory of General Artificial Intelligence, BIGAI
;
Xiamen University
;
Northeast Forestry University
;
Beijing Institute of Technology
;
Ludwig Maximilian University of Munich
;
The University of Sydney
;
C-FAIR\&school of software, Shandong University
;
State Key Lab. for Novel Software Technology, Nanjing University, P.R. China
机构
*
China Mobile Research Institute, China(中国移动研究院)
;
Beihang University, China(北京航空航天大学)
;
Beijing University of Posts and Telecommunications, China(北京邮电大学)
;
Nanyang Technological University, Singapore(南洋理工大学)
机构
*
College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院)
;
Key Laboratory of Symbolic Computation and Knowledge Engineering, Ministry of Education, Jilin University(吉林大学符号计算与知识工程重点实验室)
;
RIKEN Center for Advanced Intelligence Project(RIKEN高级智能项目中心)
;
Graduate School of Frontier Sciences, University of Tokyo(东京大学前沿科学研究生院)
Large Vision-Language Models Get Lost in Attention
大视觉-语言模型在注意力中迷失
Gongli Xi, Ye Tian, Mengyu Yang, Huahui Yi, Liang Lin, Xiaoshuai Hao, Kun Wang, Wendong Wang
机构
*
School of Cyberspace Security, Beijing University of Posts(信息安全学院,北京邮电大学)
;
State Key Laboratory of Networking and Switching Technology, Beijing University of Posts(网络与交换技术国家重点实验室,北京邮电大学)
;
School of Computer Science (National Pilot Software Engineering School), Beijing University of Posts(计算机科学学院(国家试点软件工程学院),北京邮电大学)
;
Nanyang Technological University, Singapore(新加坡南洋理工大学)
;
Institute of Information Engineering, Chinese Academy of Sciences, Beijing, China(信息工程研究所,中国科学院北京研究院)
MUSE: Resolving Manifold Misalignment in Visual Tokenization via Topological Orthogonality
MUSE:通过拓扑正交性解决视觉标记化中的流形偏移
Panqi Yang, Haodong Jing, Jiahao Chao, Tingyan Xiang, Li Lin, Yao Hu, Yang Luo, Yongqiang Ma
机构
*
State Key Laboratory of Human-Machine Hybrid Augmented Intelligence,National Engineering Research Center of Visual Information and Applications,and Institute of Artificial Intelligence and Robotics, Xi'an Jiao Tong University(人机混合增强智能国家重点实验室、视觉信息与应用国家工程研究中心、人工智能与机器人研究院、西安交通大学)
;
State Key Laboratory of Human-Machine Hybrid Augmented Intelligence,National Engineering Research Center of Visual Information(人机混合增强智能国家重点实验室、视觉信息与应用国家工程研究中心)
;
Institute of Artificial Intelligence(人工智能研究院)
;
Robotics, Xi'an Jiao Tong University(机器人,西安交通大学)
Position: agentic AI orchestration should be Bayes-consistent
位置:代理AI协调应具有贝叶斯一致性
Theodore Papamarkou, Pierre Alquier, Matthias Bauer, Wray Buntine, Andrew Davison, Gintare Karolina Dziugaite, Maurizio Filippone, Andrew Y. K. Foong, Vincent Fortuin, Dimitris Fouskakis, Jes Frellsen, Eyke Hüllermeier, Theofanis Karaletsos, Mohammad Emtiyaz Khan, Nikita Kotelevskii, Salem Lahlou, Yingzhen Li, Fang Liu, Clare Lyle, Thomas Möllenhoff, Konstantina Palla, Maxim Panov, Yusuf Sale, Kajetan Schweighofer, Artem Shelmanov, Siddharth Swaroop, Martin Trapp, Willem Waegeman, Andrew Gordon Wilson, Alexey Zaytsev
机构
*
ESSEC Business School(ESSEC商学院)
;
VinUniversity(文大学)
;
Imperial College London(伦敦帝国理工学院)
;
Mila - Quebec AI Institute(魁北克人工智能研究所)
;
Technical University of Denmark(丹麦技术大学)
;
Pyramidal Inc.(Pyramidal公司)
;
University of Notre Dame(诺特大学)
;
Cognizant AI Lab(Cognizant人工智能实验室)
;
University College London(伦敦大学学院)
;
KTH Royal Institute of Technology(瑞典皇家理工学院)
;
Ghent University(根特大学)
;
New York University(纽约大学)
机构
*
Big Data Institute, Central South University, Changsha, China. Work done while working at CityUHK as a visiting scholar.
;
Department of Computer Science \& Institute of Digital Medicine, City University of Hong Kong, Hong Kong, China
;
School of Computer Science, Central South University, Changsha, China
FRISM: Fine-Grained Reasoning Injection via Subspace-Level Model Merging for Vision-Language Models
FRISM:通过子空间级模型融合实现细粒度推理注入用于视觉-语言模型
Chenyu Huang, Peng Ye, Xudong Tan, Jinhan Mu, Shenghe Zheng, Li Shen, Tao Chen
机构
*
College of Future Information Technology, Fudan University, Shanghai, China(复旦大学未来信息科技学院,中国)
;
Shanghai Innovation Institute, China(上海创新研究院,中国)
;
The Chinese University of Hong Kong, China(香港中文大学,中国)
;
Harbin Institute of Technology, China(哈尔滨工业大学,中国)
;
Shanghai Artificial Intelligence Laboratory, China(上海人工智能实验室,中国)
;
Sun Yat-Sen University, Shenzhen, China(暨南大学深圳校区,中国)