Breaking AR's Sampling Bottleneck: Provable Acceleration via Diffusion Language Models
突破生成模型的采样瓶颈:通过扩散语言模型实现可证明的加速
Gen Li, Changxiao Cai
机构
*
Department of Statistics and Data Science, Chinese University of Hong Kong, Hong Kong(统计与数据科学系,香港中文大学)
;
Department of Industrial and Operations Engineering, University of Michigan, Ann Arbor, USA(工业与运营管理系,密歇根大学)
Mechanism Design for Federated Learning with Non-Monotonic Network Effects
联邦学习中非单调网络效应的机制设计
Xiang Li, Bing Luo, Jianwei Huang, Yuan Luo
机构
*
Shenzhen Loop Area Institute(深圳河套学院)
;
Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳人工智能与机器人社会研究所)
;
School of Science and Engineering(科学与工程学院)
;
Data Science Research Center(数据科学研究中心)
;
Duke Kunshan University(杜克昆山大学)
;
Shenzhen Key Laboratory of Crowd Intelligence Empowered Low-Carbon Energy Network(深圳 Crowd Intelligence 赋能低碳能源网络重点实验室)
;
CSIJRI Joint Research Centre on Smart Energy Storage(CSIJRI 智能储能联合研究中心)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
机构
*
Institute of Computing and Intelligence, Harbin Institute of Technology(计算与智能研究所,哈尔滨工业大学)
;
Shenzhen Loop Area Institute (SLAI)(深圳环城研究院)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Beijing University of Aeronautics and Astronautics(北京航空航天大学)
;
Baidu Inc.(百度公司)
Summary of The Inaugural Music Source Restoration Challenge
音乐源恢复挑战赛概述
Yongyi Zang, Jiarui Hai, Wanying Ge, Qiuqiang Kong, Zheqi Dai, Helin Wang, Yuki Mitsufuji, Mark D. Plumbley
机构
*
Independent Researcher(独立研究者)
;
Johns Hopkins University(约翰霍普金斯大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Sony AI(索尼人工智能)
;
King's College London(伦敦国王学院)
机构
*
Zhejiang University(浙江大学)
;
Binjiang Institute of Zhejiang University(浙江大学滨江研究院)
;
The Chinese University of Hong Kong(香港中文大学)
;
Shandong University(山东大学)
机构
*
School of Computer Science, Northwestern Polytechnical University(西北工业大学计算机学院)
;
Shenzhen Research Institute of Northwestern Polytechnical University(西北工业大学深圳研究院)
;
School of Astronautics, Northwestern Polytechnical University(西北工业大学航天学院)
;
Shaanxi University of Science & Technology(陕西科技大学)
;
Xi’an University of Architecture and Technology(西安建筑科技大学)
;
Chinese University of Hong Kong(香港中文大学)
CoINS: Counterfactual Interactive Navigation via Skill-Aware VLM
基于技能感知的反事实交互导航:通过技能感知视觉语言模型
Kangjie Zhou, Zhejia Wen, Zhiyong Zhuo, Zike Yan, Pengying Wu, Ieng Hou U, Shuaiyang Li, Han Gao, Kang Ding, Wenhan Cao, Wei Pan, Chang Liu
机构
*
School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院)
;
Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系)
;
College of Design and Engineering, National University Of Singapore(新加坡国立大学设计与工程学院)
;
Department of Computer Science, The University of Manchester(曼彻斯特大学计算机科学系)
Venus: An Efficient Edge Memory-and-Retrieval System for VLM-based Online Video Understanding
Venus: 一种高效的边缘内存与检索系统用于基于VLM的在线视频理解
Shengyuan Ye, Bei Ouyang, Tianyi Qian, Liekang Zeng, Mu Yuan, Xiaowen Chu, Weijie Hong, Xu Chen
机构
*
School of Computer Science and Engineering, Sun Yat-sen University, Guangzhou, China(计算机科学与工程学院,中山大学,广州,中国)
;
Department of Information Engineering, The Chinese University of Hong Kong, Hong Kong SAR, China(信息工程系,香港中文大学,香港特别行政区,中国)
;
Shenzhen Smart City Communications Co., Ltd., China(深圳智慧城市通信有限公司,中国)
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
Peking University(北京大学)
;
Sun Yat-Sen University(中山大学)
;
Chinese University of Hong Kong(香港中文大学)
NeuronScope: A Multi-Agent Framework for Explaining Polysemantic Neurons in Language Models
NeuronScope:一种用于解释语言模型中多义神经元的多智能体框架
Weiqi Liu, Yongliang Miao, Haiyan Zhao, Yanguang Liu, Mengnan Du
机构
*
Wuhan University(武汉大学)
;
Hong Kong Baptist University(香港 Baptist大学)
;
New Jersey Institute of Technology(新泽西理工学院)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
Boosting In-Silicon Directed Evolution with Fine-Tuned Protein Language Model and Tree Search
通过微调蛋白质语言模型和树搜索提升硅基定向进化
Yaodong Yang, Yang Wang, Jinpeng Li, Pei Guo, Da Han, Guangyong Chen, Pheng-Ann Heng
机构
*
Department of Computer Science(计算机科学与工程系)
;
Engineering, The Chinese University of Hong Kong(香港中文大学)
;
Hangzhou Institute of Medicine, Chinese Academy of Sciences(中国科学院杭州医学研究所)
Adapting Vision-Language Foundation Model for Next Generation Medical Ultrasound Image Analysis
为下一代医学超声图像分析适应视觉-语言基础模型
Jingguo Qu, Xinyang Han, Jia Ai, Juan Wu, Tong Zhao, Tonghuan Xiao, Sheng Ning, Yuqi Yang, Jing Qin, Ann Dorothy King, Winnie Chiu-Wing Chu, Jing Cai, Michael Tin-Cheung Ying
机构
*
Department of Health Technology and Informatics, The Hong Kong Polytechnic University(健康科技与信息学系,香港理工大学)
;
Centre for Smart Health and School of Nursing, The Hong Kong Polytechnic University(智能健康中心及护理学院,香港理工大学)
;
Department of Imaging and Interventional Radiology, The Chinese University of Hong Kong(影像与介入放射学系,香港中文大学)
;
Suzhou Hospital of Traditional Chinese Medicine Affiliated to Nanjing University of Chinese Medicine(南京中医药大学附属苏州中医医院)
;
Department of Ultrasound, The Affiliated Changzhou No. 2 People's Hospital of Nanjing Medical University(南京医科大学附属常州第二人民医院超声科)
机构
*
The Chinese University of Hong Kong(香港中文大学)
;
City University of Hong Kong(香港城市大学)
;
Tencent AI Lab(腾讯AI实验室)
;
Singapore Management University(新加坡管理学院)
VisualCloze: A Universal Image Generation Framework via Visual In-Context Learning
VisualCloze: 一种通过视觉上下文学习实现通用图像生成的框架
Zhong-Yu Li, Ruoyi Du, Juncheng Yan, Le Zhuo, Qilong Wu, Zhen Li, Peng Gao, Zhanyu Ma, Ming-Ming Cheng
机构
*
VCIP, CS, Nankai University(VCIP、计算机科学、南开大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Tsinghua University(清华大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
The Chinese University of Hong Kong(香港中文大学)
Linear Script Representations in Speech Foundation Models Enable Zero-Shot Transliteration
语音基础模型中的线性脚本表示可实现零样本转写
Ryan Soh-Eun Shim, Kwanghee Choi, Kalvin Chang, Ming-Hao Hsu, Florian Eichin, Zhizheng Wu, Alane Suhr, Michael A. Hedderich, David Harwath, David R. Mortensen, Barbara Plank
机构
*
LMU Munich(慕尼黑大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
Carnegie Mellon University(卡内基梅隆大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
Hybrid and Unitary PEFT for Resource-Efficient Large Language Models
混合与单位元PEFT用于资源高效的大型语言模型
Haomin Qi, Zihan Dai, Chengbo Huang
机构
*
Department of Information Engineering, The Chinese University of Hong Kong, Hong Kong(信息工程系,香港中文大学)
;
Department of Electrical and Computer Engineering, University of California San Diego, USA(电气与计算机工程系,加州大学圣地亚哥分校)
;
Department of Computer Science, University of Copenhagen, Denmark(计算机科学系,哥本哈根大学)
;
Department of Electrical Engineering, Columbia University, USA(电气工程系,哥伦比亚大学)