StyleDrive: Towards Driving-Style Aware Benchmarking of End-To-End Autonomous Driving
Ruiyang Hao, Bowen Jing, Haibao Yu, Zaiqing Nie
机构
*
AIR, Tsinghua University(空气动力学研究所,清华大学)
;
King’s College London(伦敦国王学院)
;
The University of Manchester(曼彻斯特大学)
;
The University of Hong Kong(香港大学)
ElasticMM: Efficient Multimodal LLMs Serving with Elastic Multimodal Parallelism
Zedong Liu, Shenggan Cheng, Guangming Tan, Yang You, Dingwen Tao
机构
*
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
University of Electronic Science and Technology of China(电子科技大学)
;
National University of Singapore(新加坡国立大学)
专题命中
VLM训练与架构
:multimodal large language model(abstract);MLLM(abstract);分类 cs.LG
CommentsAccepted at NeurIPS 2025 Oral (Thirty-Ninth Conference on Neural Information Processing Systems)
Bridging Vision, Language, and Mathematics: Pictographic Character Reconstruction with Bézier Curves
Zihao Wan, Pau Tong Lin Xu, Fuwen Luo, Ziyue Wang, Peng Li, Yang Liu
机构
*
Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University, Beijing, China(计算机科学与技术系,人工智能研究院,清华大学,北京,中国)
;
Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China(人工智能产业研究院(AIR),清华大学,北京,中国)
SCOPE: Saliency-Coverage Oriented Token Pruning for Efficient Multimodel LLMs
Jinhong Deng, Wen Li, Joey Tianyi Zhou, Yang He
机构
*
University of Electronic Science and Technology of China(电子科技大学)
;
Shenzhen Institute for Advanced Study(深圳先进研究 institute)
;
CFAR, Agency for Science, Technology and Research (A*STAR)(科技研究局(A*STAR)认知与人工智能研究中心)
;
IHPC, Agency for Science, Technology and Research (A*STAR)(科技研究局(A*STAR)人工智能中心)
专题命中
VLM训练与架构
:LLaVA(abstract);multimodal large language model(abstract);分类 cs.CV
CoIDO: Efficient Data Selection for Visual Instruction Tuning via Coupled Importance-Diversity Optimization
Yichen Yan, Ming Zhong, Qi Zhu, Xiaoling Gu, Jinpeng Chen, Huan Li
机构
*
The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室)
;
Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院)
;
Hangzhou Dianzi University(杭州电子科技大学)
;
School of Computer Science (National Pilot Software Engineering School), BUPT(计算机学院(国家级试点软件工程学院),北京邮电大学)
专题命中
VLM训练与架构
:LLaVA(abstract);multimodal large language model(abstract);分类 cs.CV
Comments22 pages, 8 figures, 39th Conference on Neural Information Processing Systems (NeurIPS 2025)
机构
*
Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative, Institute of Digital Twin, EIT, Ningbo(宁波空间智能与数字衍生关键实验室,数字孪生研究院,EIT,宁波)
;
Shanghai Jiao Tong University(上海交通大学)
;
Hong Kong Polytechnic University(香港理工大学)
;
Meituan Inc.(美团公司)
;
National University of Singapore(新加坡国立大学)
专题命中
VLM训练与架构
:LLaVA(abstract);multimodal large language model(abstract);分类 cs.CV
机构
*
Institute of Software Chinese Academy of Sciences(中国科学院软件研究所)
;
University of the Chinese Academy of Sciences(中国科学院大学)
;
Beijing University of Technology(北京理工大学)