Sink-Token-Aware Pruning for Fine-Grained Video Understanding in Efficient Video LLMs
面向高效视频大语言模型的sink-token感知剪枝:用于细粒度视频理解
Kibum Kim, Jiwan Kim, Kyle Min, Yueqi Wang, Jinyoung Moon, Julian McAuley, Chanyoung Park
机构
*
Korea Advanced Institute of Science and Technology (KAIST)(韩国高级科学技术研究院)
;
Oracle
;
University of California, San Diego(加州大学圣地亚哥分校)
;
Electronics and Telecommunications Research Institute (ETRI)(电子电信研究院)
StructSAM: Structure- and Spectrum-Preserving Token Merging for Segment Anything Models
StructSAM: 面向分割一切模型的结构与谱保持令牌合并
Duy M. H. Nguyen, Tuan A. Tran, Duong Nguyen, Siwei Xie, Trung Q. Nguyen, Mai T. N. Truong, Daniel Palenicek, An T. Le, Michael Barz, TrungTin Nguyen, Tuan Dam, Ngan Le, Minh Vu, Khoa Doan, Vien Ngo, Pengtao Xie, James Zou, Daniel Sonntag, Jan Peters, Mathias Niepert
机构
*
University of Stuttgart(斯图加特大学)
;
DFKI
;
Max Planck Research School(马克斯·普朗克研究学校)
;
University of Oldenburg(奥尔登堡大学)
;
Technical University of Darmstadt(达姆施塔特技术大学)
;
VinRobotics
;
VinUniversity(Vin大学)
;
Aalto University(阿莱大学)
;
Queensland University of Technology(昆士兰技术大学)
;
HUST(华中科技大学)
;
Technical University of Denmark(丹麦技术大学)
;
University of Arkansas(阿肯色大学)
;
UC San Diego(圣地亚哥大学)
;
Stanford University(斯坦福大学)
United Minds or Isolated Agents? Exploring Coordination of LLMs under Cognitive Load Theory
统一思维还是孤立代理?探索认知负荷理论下LLM的协调
HaoYang Shang, Xuan Liu, Zi Liang, Jie Zhang, Haibo Hu, Song Guo
机构
*
Hong Kong University of Science and Technology(香港科技大学)
;
University of California San Diego(加州大学圣地亚哥分校)
;
Hong Kong Polytechnic University(香港理工大学)