机构
*
organization= Department of Hepatobiliary Surgery, the Second Affiliated Hospital of Chongqing Medical University , city= Chongqing , postcode= 400010 , country= China
;
organization= State Key Laboratory of Respiratory Health
;
Multimorbidity, Institute of Basic Medical Sciences \& School of Basic Medicine, Chinese Academy of Medical Sciences \& Peking Union Medical College , city= Beijing , postcode= 100005 , country= China
;
organization= School of Computer Science
;
Informatics, Cardiff University , city= Wales , postcode= CF24 0DE , country= United Kingdom
;
organization= Department of Medical Oncology, the First Hospital of China Medical University , city= Shenyang , postcode= 110001 , country= China
;
organization= Institute for Innovation
;
Development, Tsinghua University , city= Beijing , postcode= 100086 , country= China
;
organization= Department of Liver Surgery, Peking Union Medical College Hospital, Chinese Academy of Medical Sciences \& Peking Union Medical College , city= Beijing , country= China
Hyperbolic Additive Margin Softmax with Hierarchical Information for Speaker Verification
双曲加法边距软max与层次信息的说话人验证
Zhihua Fang, Liang He
机构
*
School of Computer Science and Technology(计算机科学与技术学院)
;
Xinjiang University(新疆大学)
;
Xinjiang Multimodal Information Technology Engineering Research Center(新疆多模态信息处理工程技术研究中心)
;
School of Intelligence Science and Technology(智能科学与技术学院)
;
Department of Electronic Engineering(电子工程系)
;
Tsinghua University(清华大学)
XM-ALIGN: Unified Cross-Modal Embedding Alignment for Face-Voice Association
XM-ALIGN:面向人脸-语音关联的统一跨模态嵌入对齐框架
Zhihua Fang, Shumei Tao, Junxu Wang, Liang He
机构
*
School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院)
;
Xinjiang Multimodal Information Technology Engineering Research Center(新疆多模态信息处理工程技术研究中心)
;
Urumqi Branch, China Mobile Group Xinjiang Co., Ltd(中国移动新疆乌鲁木齐分公司)
;
School of Intelligence Science and Technology, Xinjiang University(新疆大学智能科学与技术学院)
;
Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)
From Scene to Object: Text-Guided Dual-Gaze Prediction
从场景到物体:文本引导的双目预测
Zehong Ke, Yanbo Jiang, Jinhao Li, Zhiyuan Liu, Yiqian Tu, Qingwen Meng, Heye Huang, Jianqiang Wang
机构
*
School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动系统学院)
;
Cho Chun Shik Graduate School of Mobility, Korea Advanced Institute of Science and Technology(Cho Chun Shik 移动研究生院,韩国科学技术院)
RISE: Self-Improving Robot Policy with Compositional World Model
RISE:具有组合世界模型的自改进机器人策略
Jiazhi Yang, Kunyang Lin, Jinwei Li, Wencong Zhang, Tianwei Lin, Longyan Wu, Zhizhong Su, Hao Zhao, Ya-Qin Zhang, Li Chen, Ping Luo, Xiangyu Yue, Hongyang Li
机构
*
The Chinese University of Hong Kong(香港中文大学)
;
Kinetix AI
;
The University of Hong Kong(香港大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Horizon Robotics
;
Tsinghua University(清华大学)
MICo-150K: A Comprehensive Dataset Advancing Multi-Image Composition
MICo-150K:一个多图像合成的综合数据集
Xinyu Wei, Kangrui Cen, Hongyang Wei, Zhen Guo, Kai Cui, Bairui Li, Zeqing Wang, Jinrui Zhang, Lei Zhang
机构
*
Hong Kong Polytechnic University(香港理工大学)
;
Tsinghua University(清华大学)
;
Peking University(北京大学)
;
Sun Yat-Sen University(中山大学)
;
OPPO Research Institute(OPPO研究院)
CommentsPublished in COLT 2024. This arXiv version refines Assumption 4.1 (d); adds discussions on related works in Appendix A; and corrects the kappa dependency in the upper bounds