Efficient Audio-Visual Speech Separation with Discrete Lip Semantics and Multi-Scale Global-Local Attention
高效音频-视觉语音分离与离散唇语语义及多尺度全局-局部注意力
Kai Li, Kejun Gao, Xiaolin Hu
机构
*
Department of Computer Science and Technology, Institute for AI, BNRist, Tsinghua University, Beijing(计算机科学与技术系,人工智能研究院,BNRist,清华大学,北京)
;
IDG/McGovern Institute for Brain Research, Tsinghua University, Beijing(IDG/麦克戈文脑研究 institute,清华大学,北京)
;
Chinese Institute for Brain Research (CIBR), Beijing(中国脑科学研究院(CIBR),北京)
机构
*
Department of Civil Engineering, Tsinghua University, Beijing, China(清华大学土木工程系)
;
Department of Civil and Environmental Engineering, Massachusetts Institute of Technology, Cambridge, MA 02139(麻省理工学院土木与环境工程系)
;
Department of Urban Studies and Planning, Massachusetts Institute of Technology, Cambridge, MA 20139(麻省理工学院城市研究与规划系)
;
Department of Management Science and Engineering, Stanford University, Stanford, CA 94305(斯坦福大学管理科学与工程系)
World2Mind: Cognition Toolkit for Allocentric Spatial Reasoning in Foundation Models
World2Mind: 用于基础模型的方位认知工具包
Shouwei Ruan, Bin Wang, Zhenyu Wu, Qihui Zhu, Yuxiang Zhang, Hang Su, Yubin Wang
机构
*
Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院)
;
Huawei Noah’s Ark Lab(华为诺亚方舟实验室)
;
Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center, Tsinghua University(清华大学人工智能院计算机科学与技术系、清华大学-博世联合机器学习中心、THBI实验室、BNRist中心、清华大学)
机构
*
Tsinghua University(清华大学)
;
University of California San Diego(加州大学圣地亚哥分校)
;
West China Second University Hospital, Sichuan University(四川大学华西第二医院)
Lightweight Time Series Data Valuation on Time Series Foundation Models via In-Context Finetuning
基于上下文微调的轻量时间序列数据估值方法
Shunyu Wu, Tianyue Li, Yixuan Leng, Jingyi Suo, Jian Lou, Dan Li, See-Kiong Ng
机构
*
Sun Yat-sen University State Key Laboratory of Internet Architecture(中山大学互联网架构国家重点实验室)
;
Tsinghua University(清华大学)
;
National University of Singapore(新加坡国立大学)
SPAN: Spatial-Projection Alignment for Monocular 3D Object Detection
SPAN: 用于单目3D目标检测的空间-投影对齐
Yifan Wang, Yian Zhao, Fanqi Pu, Xiaochen Yang, Yang Tang, Xi Chen, Wenming Yang
机构
*
Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)
;
School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院)
;
School of Mathematics and Statistics, University of Glasgow(格拉斯哥大学数学与统计学学院)
;
Basic Algorithm Center, PCG, Tencent(腾讯计算机系统有限公司基础算法中心)
LLaVAShield: Safeguarding Multimodal Multi-Turn Dialogues in Vision-Language Models
LLaVAShield: 保障视觉语言模型中的多模态多轮对话安全
Guolei Huang, Qinzhi Peng, Gan Xu, Yao Huang, Yuxuan Lu, Yongjun Shen
机构
*
Southeast University(东南大学)
;
University of California, Santa Cruz(加州大学圣克鲁兹分校)
;
Zhejiang University of Technology(浙江工业大学)
;
Tsinghua University(清华大学)
;
RealAI
机构
*
State Key Laboratory of Clean and Efficient Turbomachinery Power Equipment, Department of Mechanical Engineering, Tsinghua University(清洁高效 turbomachinery 动力设备国家重点实验室,机械工程系,清华大学)
;
Key Laboratory for Advanced Materials Processing Technology, Ministry of Education(先进材料加工技术重点实验室,教育部)
PolyFormer: learning efficient reformulations for scalable optimization under complex physical constraints
PolyFormer: 为在复杂物理约束下可扩展优化学习高效重述
Yilin Wen, Yi Guo, Bo Zhao, Wei Qi, Zechun Hu, Colin Jones, Jian Sun
机构
*
School of Electrical and Electronic Engineering(电气电子工程学院)
;
North China Electric Power University(华北电力大学)
;
Department of Electrical Engineering(电气工程系)
;
Tsinghua University(清华大学)
;
School of Automation(自动化学院)
;
Beijing Institute of Technology(北京理工大学)
;
Department of Industrial Engineering(工业工程系)
;
Laboratory for Systems and Control(系统与控制实验室)
;
École Polytechnique Fédérale de Lausanne (EPFL)(瑞士联邦理工学院(EPFL))
机构
*
Tsinghua University(清华大学)
;
University of Pennsylvania(宾夕法尼亚大学)
;
Syracuse University(Syracuse大学)
;
National University of Singapore(新加坡国立大学)
;
Royal College of Art(皇家艺术学院)
SAMoE-VLA: A Scene Adaptive Mixture-of-Experts Vision-Language-Action Model for Autonomous Driving
SAMoE-VLA:一种面向自动驾驶的场景自适应混合专家视觉-语言-动作模型
Zihan You, Hongwei Liu, Chenxu Dang, Zhe Wang, Sining Ang, Aoqi Wang, Yan Wang
机构
*
Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)
;
School of Instrument Science and Engineering, Southeast University(仪器科学与工程学院,东南大学)
;
Zhili College, Tsinghua University(紫荆学院,清华大学)
;
School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(人工智能与自动化学院,华中科技大学)
;
Department of Automation, University of Science and Technology of China(自动化学院,中国科学技术大学)
;
Department of Automation, University of Science and Technology Beijing(自动化学院,北京科技大学)
机构
*
Shanghai AI Lab(上海人工智能实验室)
;
Northwestern Polytechnical University(西北工业大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Peking University(北京大学)
;
Nanyang Technological University(南洋理工大学)
;
Beihang University(北京航空航天大学)
;
Sichuan University(四川大学)
;
Tsinghua University(清华大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Fudan University(复旦大学)
;
Hong Kong University of Science and Technology(香港科技大学)
Compressed Proximal Federated Learning for Non-Convex Composite Optimization on Heterogeneous Data
压缩的联邦学习用于非凸复合优化在异构数据上
Pu Qiu, Chen Ouyang, Yongyang Xiong, Keyou You, Wanquan Liu, Yang Shi
机构
*
School of Intelligent Systems Engineering, Sun Yat-Sen University(中山大学智能系统工程学院)
;
Department of Automation, Beijing National Research Center for Information Science and Technology, Tsinghua University(清华大学自动化系)
;
Department of Mechanical Engineering, University of Victoria(维多利亚大学机械工程系)
Underwater Embodied Intelligence for Autonomous Robots: A Constraint-Coupled Perspective on Planning, Control, and Deployment
水下具身智能:一种约束耦合视角下的规划、控制与部署
Jingzehua Xu, Guanwen Xie, Jiwei Tang, Shuai Zhang, Xiaofan Li
机构
*
Department of Mechanical Engineering, The University of Hong Kong(香港大学机械工程系)
;
Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生学院)
;
Department of Data and Systems Engineering, The University of Hong Kong(香港大学数据与系统工程系)
;
Department of Data Science, New Jersey Institute of Technology(新泽西理工学院数据科学系)
CryoNet.Refine: A One-step Diffusion Model for Rapid Refinement of Structural Models with Cryo-EM Density Map Restraints
CryoNet.Refine: 一种用于利用冷冻电镜密度图约束快速优化结构模型的一步扩散模型
Fuyao Huang, Xiaozhu Yu, Kui Xu, Qiangfeng Cliff Zhang
机构
*
State Key Laboratory of Membrane Biology, Beijing Frontier Research Center of Biological Structures, Tsinghua-Peking Joint Center for Life Sciences, School of Life Sciences, Tsinghua University, Beijing, China(膜生物学国家重点实验室,北京生物结构前沿研究中心,清华大学-北京大学联合生命科学中心,生命科学学院,清华大学,北京,中国)
;
State Key Laboratory of Membrane Biology–Membrane Structure and Artificial Intelligence Biology Branch, Hangzhou, China(膜生物学国家重点实验室——生物结构与人工智能生物学分支,杭州,中国)
;
State Key Laboratory of Membrane Biology, Beijing Tsinghua Institute for Frontier Interdisciplinary Innovation, Beijing, China(膜生物学国家重点实验室,北京清华大学前沿交叉创新研究院,北京,中国)