Parameter-Efficient CLIP Adaptation for 3D Understanding via Unified Tokenization
用于3D理解的参数高效CLIP适配:通过统一分词实现
Guofeng Mei, Qinfeng Xiao, Bin Ren, Luigi Riz, Juan Liu, Xiaoshui Huang, Xu Zheng, Nicu Sebe, Ming-Hsuan Yang, Fabio Poiesi
机构
*
Fondazione Bruno Kessler(布鲁诺·科塞拉基金会)
;
University of Trento(特伦托大学)
;
University of Pisa(比萨大学)
;
Beijing Forestry University(北京林业大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Hong Kong University of Science and Technology (GZ)(香港科技大学)
;
Shandong University(山东大学)
;
University of California, Merced(加州大学默塞德分校)
机构
*
GigaAI(字节跳动人工智能实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Hong Kong University of Science and Technology(香港科技大学)
;
University of Leeds(利兹大学)
;
Cornell University(康奈尔大学)
;
Tsinghua University(清华大学)
;
Nanjing University of Science and Technology(南京理工大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
FAWTD(一汽技术开发部)
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Shanghai Qizhi Institute(上海启智研究院)
;
Huawei Technologies Co.,Ltd(华为技术有限公司)
;
Institute of Computing Technology, Chinese Academy of Science(中国科学院计算技术研究所)
专题命中
效率与部署
:large language model(abstract);language model(abstract)
机构
*
State Key Lab of Processors, Institute of Computing Technology, CAS(处理器国家重点实验室,计算技术研究所,中国科学院)
;
Jiangsu Key Laboratory of AI for Industries, Institute of AI for Industries, CAS(江苏人工智能工业重点实验室,人工智能工业研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Cambricon Technologies(寒武科技)
;
Intelligent Software Research Center, Institute of Software, CAS(软件研究所智能软件研究中心,中国科学院)
;
University of Science and Technology of China(中国科学技术大学)
CHIA: An open-source framework for principled, agentic AI-driven hardware/software co-design research
CHIA: 一个用于原则性、智能体AI驱动的硬件/软件协同设计研究的开源框架
Angela Cui, Ferran Hermida-Rivera, Jack Toubes, Raghav Gupta, Jim Fang, Chengyi Lux Zhang, Ella Schwarz, Junha Kim, Yakun Sophia Shao, Borivoje Nikolic, Christopher W. Fletcher, Sagar Karandikar
WikiCLIP: An Efficient Contrastive Baseline for Open-domain Visual Entity Recognition
WikiCLIP: 一种高效的开放领域视觉实体识别对比基线
Shan Ning, Longtian Qiu, Jiaxuan Sun, Xuming He
机构
*
ShanghaiTech University(上海科技大学)
;
Shanghai Engineering Research Center of Intelligent Vision and Imaging(上海智能视觉与成像工程技术研究中心)
;
Lingang Laboratory(临港实验室)
专题命中
效率与部署
:large language model(abstract);language model(abstract)