机构
*
China University of Petroleum-Beijing at Karamay(中国石油大学(北京)克拉玛依校区)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Tianjin University(天津大学)
Parameter-Efficient CLIP Adaptation for 3D Understanding via Unified Tokenization
用于3D理解的参数高效CLIP适配:通过统一分词实现
Guofeng Mei, Qinfeng Xiao, Bin Ren, Luigi Riz, Juan Liu, Xiaoshui Huang, Xu Zheng, Nicu Sebe, Ming-Hsuan Yang, Fabio Poiesi
机构
*
Fondazione Bruno Kessler(布鲁诺·科塞拉基金会)
;
University of Trento(特伦托大学)
;
University of Pisa(比萨大学)
;
Beijing Forestry University(北京林业大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Hong Kong University of Science and Technology (GZ)(香港科技大学)
;
Shandong University(山东大学)
;
University of California, Merced(加州大学默塞德分校)
DeCLIP: Decoupled Prompting for Multi-Label Class-Incremental Learning with CLIP
DeCLIP:基于CLIP的多标签类增量学习的解耦提示
Kaile Du, Zihan Ye, Junzhou Xie, Yixi Shen, Yuyang Li, Fuyuan Hu, Ling Shao, Guangcan Liu, Joost van de Weijer, Fan Lyu
机构
*
School of Automation, Southeast University, China(东南大学自动化学院)
;
University of the Chinese Academy of Sciences, China(中国科学院大学)
;
Suzhou University of Science and Technology, China(苏州科技大学)
;
Computer Vision Center, Spain(西班牙计算机视觉中心)
A Survey of Large Audio Language Models: Generalization, Trustworthiness, and Outlook
大型音频语言模型综述:通用性、可信度与展望
Kaiwen Luo, Zhenhong Zhou, Leyan Wang, Liang Lin, Tianyu Shao, Yuanhe Zhang, Yang Xiao, Yuxuan Li, Miao Yu, Kailin Lyu, Jiaming Zhang, Li Sun, Songze Li, Yueming Wu, Ting Dang, Xiaojun Jia, Dongrui Liu, Kai Li, Rohan Kumar Das, Siyuan Liang, Xinfeng Li, Qiankun Li, Jing Chen, Xingjun Ma, Kun Wang, Junhao Dong, Deqing Zou, Yu Cheng, Xia Hu, Zhigang Zeng, Sen Su, Yang Liu, Yu-Gang Jiang, Philip S. Yu, Yew-Soon Ong
机构
*
Nanyang Technological University(南洋理工大学)
;
Independent Researcher(独立研究者)
;
The University of Melbourne(墨尔本大学)
;
North China Electric Power University(华北电力大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Huazhong University of Science and Technology(华中科技大学)
;
Tsinghua University(清华大学)
;
Fortemedia Singapore(富媒体新加坡)
;
Tencent(腾讯)
;
Fudan University(复旦大学)
;
Wuhan University(武汉大学)
;
Chinese University of Hong Kong(香港中文大学)
;
Chongqing University of Posts and Telecommunications(重庆邮电大学)
;
University of Illinois Chicago(伊利诺伊大学芝加哥分校)
Ensemble Deep Learning Approaches for AI-Altered Video Detection
用于人工智能篡改视频检测的集成深度学习方法
Laiba Khan, Hung-Mao Wu, Wei Lin, Frank Bi, Yousef Abdelhadi, Joshua Jung
机构
*
Department of Mathematical and Computational Sciences, University of Toronto Mississauga(多伦多大学密西沙加分校数学与计算科学系)
;
Department of Mathematical and Computational Sciences, University of Toronto(多伦多大学数学与计算科学系)
;
University of Toronto(多伦多大学)
Unifying biomedical knowledge in a modern multimodal graph
OptimusKG:统一生物医学知识的现代多模态图
Lucas Vittor, Ayush Noori, Iñaki Arango, Joaquín Polonuer, Sam Rodriques, Andrew White, David A. Clifton, Marinka Zitnik
机构
*
Department of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学系)
;
Department of Engineering Science, University of Oxford(牛津大学工程科学系)
;
Edison Scientific Inc.(Edison科学公司)
;
Oxford Suzhou Centre for Advanced Research, University of Oxford(牛津大学苏格兰研究中心)
;
Broad Institute of MIT and Harvard(MIT与哈佛大学Broad研究所)
;
Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University(哈佛大学自然与人工智能研究所)
;
Harvard Data Science Initiative(哈佛大学数据科学计划)
机构
*
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
;
City University of Hong Kong(香港城市大学)
;
Southern University of Science and Technology(南方科技大学)
;
Pengcheng Laboratory(鹏城实验室)
MMPhysVideo: Physically Plausible Video Generation Through Joint RGB-Perception Modeling
MMPhysVideo: 通过联合多模态建模提升视频生成的物理合理性
Shubo Lin, Xuanyang Zhang, Wei Cheng, Weiming Hu, Gang Yu, Jin Gao
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(中国科学院自动化研究所多模态人工智能系统国家重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
StepFun(阶跃星辰)
;
Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(多模态信息超级智能安全北京市重点实验室)
;
School of Information Science and Technology, Shanghai Tech University(上海科技大学信息科学与技术学院)
SymphonyGen: 3D Hierarchical Orchestral Generation with Controllable Harmony Skeleton
SymphonyGen:具有可控和声骨架的3D分层交响乐生成
Xuzheng He, Nan Nan, Zhilin Wang, Ziyue Kang, Zhuoru Mo, Ao Li, Yu Pan, Xiaobing Li, Feng Yu, Xiaohong Guan
机构
*
Department of AI Music and Music Information Technology, Central Conservatory of Music(中央音乐学院人工智能音乐与音乐信息科技系)
;
Frontier Institute of Science and Technology, and Interdisciplinary Research Center of Frontier Science and Technology, Xi’an Jiaotong University(西安交通大学前沿科学与技术研究院及交叉科学与技术 interdisciplinary research center)
;
University of Science and Technology of China(中国科学技术大学)
;
Shenzhen University(深圳大学)
DriveCode: Domain Specific Numerical Encoding for LLM-Based Autonomous Driving
DriveCode: 针对基于LLM的自动驾驶的领域特定数值编码
Zhiye Wang, Yanbo Jiang, Rui Zhou, Bo Zhang, Fang Zhang, Zhenhua Xu, Yaqin Zhang, Jianqiang Wang
机构
*
School of Information Science and Engineering, Lanzhou University(兰州大学信息科学与工程学院)
;
The School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动性学院)
;
The Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)
;
DiDi, Beijing, China(滴滴出行)
;
State Key Laboratory of Intelligent Green Vehicle and Mobility, Tsinghua University(清华大学智能绿色车辆与移动性国家重点实验室)