StreamingTalker: Audio-driven 3D Facial Animation with Autoregressive Diffusion Model
StreamingTalker: 基于音频的3D面部动画与自回归扩散模型
Yifan Yang, Zhi Cen, Sida Peng, Xiangwei Chen, Yifu Deng, Xinyu Zhu, Fan Jia, Xiaowei Zhou, Hujun Bao
机构
*
State Key Laboratory of CAD&CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室)
;
Ant Group(蚂蚁集团)
;
College of Computer Science, Zhejiang University(浙江大学计算机学院)
机构
*
Zhejiang University(浙江大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
East China Normal University(华东师范大学)
;
Fudan University(复旦大学)
;
Central South University(中南大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Shanghai Jiao Tong University(上海交通大学)
;
University of Science and Technology of China(中国科学技术大学)
ORACLE: Anticipating Scams from Partial Trajectories in Streaming App Usage
ORACLE:从流式应用使用轨迹中预见诈骗
Wenbo Gao, Songbai Tan, Zhongan Wang, Fei Shen, Gang Xu, Huiping Zhuang, Yunyun Yang, Ming Li, Xiaofeng Zhu
机构
*
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
Shenzhen University(深圳大学)
;
Zhejiang University(浙江大学)
;
National University of Singapore(新加坡国立大学)
;
Guangming Laboratory(光明实验室)
;
South China University of Technology(华南理工大学)
;
Hainan University(海南大学)
Decomposed Vision-Language Alignment for Fine-Grained Open-Vocabulary Segmentation
分解式视觉-语言对齐用于细粒度开放词汇分割
Chenhao Wang, Yingrui Ji, Yu Meng, Yao Zhu
机构
*
Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空航天信息研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Zhejiang University(浙江大学)
BootstrapAgent: Distilling Repository Setup into Reusable Agent Knowledge
BootstrapAgent: 将仓库设置提炼为可重用的代理知识
Sihan Fu, Oucheng Liu, Shiyuan Wang, Jin Shi, Chengkun Wei
机构
*
Zhejiang University(浙江大学)
;
The Australian National University(澳大利亚国立大学)
;
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
机构
*
Zhejiang University(浙江大学)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
University of California, Irvine(加州大学伊维特分校)
;
The University of Hong Kong(香港大学)
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Peking University(北京大学)
;
Zhejiang University(浙江大学)
;
Xi'an Jiaotong University(西安交通大学)
;
East China University of Science and Technology(东华大学)
;
The Chinese University of Hong Kong(香港中文大学)
机构
*
Zhejiang University(浙江大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
Vorynel(沃伊内尔)
;
Xinjiang University(新疆大学)
;
Wuhan Polytechnic University(武汉职业技术学院)
;
Tianjin University(天津大学)
Integrating chemical structures as treatments improves representations of microscopy images for morphological profiling
将化学结构作为治疗手段提高显微镜图像的表示以进行形态学分析
Yemin Yu, Emre Hayir, Neil Tenenholtz, Lester Mackey, Ying Wei, David Alvarez-Melis, Ava P. Amini, Alex X. Lu
机构
*
Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系)
;
Microsoft Research(微软研究院)
;
Department of Computer Science, Zhejiang University(浙江大学计算机科学系)
机构
*
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
State Key Laboratory of Transvascular Implantation Devices and TIDRI(血管植入设备国家重点实验室和TIDRI)
;
Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence(浙江医学影像人工智能重点实验室)
;
School of Data Science of Engineering, East China Normal University(华东师范大学工程数据科学学院)
;
Second Affiliated Hospital and Liangzhu Laboratory, Zhejiang University School of Medicine(浙江大学医学院第二附属医院和良渚实验室)
;
Alibaba Group(阿里巴巴集团)
DynamicNER: A Dynamic, Multilingual, and Fine-Grained Dataset for LLM-based Named Entity Recognition
DynamicNER: 一种动态、多语言和细粒度的用于基于大语言模型的命名实体识别的数据集
Hanjun Luo, Yingbin Jin, Xinfeng Li, Xuecheng Liu, Ruizhe Chen, Tong Shang, Kun Wang, Qingsong Wen, Zuozhu Liu
机构
*
New York University Abu Dhabi(纽约大学阿布扎赫德分校)
;
Zhejiang University(浙江大学)
;
The Hong Kong Polytechnic University(香港理工大学)
;
Nanyang Technology University(南阳技术大学)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Texas A&M University(德克萨斯大学)
;
Squirrel AI
机构
*
Zhejiang University(浙江大学)
;
Zhejiang Lab(浙江省实验室)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Nanyang Technological University(南洋理工大学)
;
Rutgers University(罗格斯大学)
GeRM: A Generative Rendering Model From Physically Realistic to Photorealistic
GeRM:从物理真实到照片级的生成渲染模型
Jiayuan Lu, Rengan Xie, Xuancheng Jin, Zhizhen Wu, Qi Ye, Tian Xie, Hujun Bao, Rui Wang. Yuchi Huo
机构
*
State Key Lab of CAD\&CG, Zhejiang University
;
Zhejiang Lab China
;
State Key Laboratory of Industrial Control Technology, Zhejiang University China
;
Zhejiang University China
;
Zhejiang Lab
;
State Key Laboratory of Industrial Control Technology, Zhejiang University
;
Zhejiang University
Energy-Regularized Sequential Model Editing on Hyperspheres
超球面能量正则化的序列模型编辑
Qingyuan Liu, Jia-Chen Gu, Yunzhi Yao, Hong Wang, Nanyun Peng
机构
*
Columbia University(哥伦比亚大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Zhejiang University(浙江大学)
;
University of Science and Technology of China(中国科学技术大学)
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
National University of Singapore(新加坡国立大学)
;
Nanyang Technological University(南洋理工大学)
;
Zhejiang University(浙江大学)
Rethinking Molecular OOD Generalization via Target-Aware Source Selection
重新思考分子OOD泛化 via 目标感知源选择
Zhuohao Lin, Kun Li, Jiameng Chen, Jiajun Yu, Duanhua Cao, Yizhen Zheng, Wenbin Hu
机构
*
Department of Data Science and Artificial Intelligence, Monash University(墨尔本大学数据科学与人工智能系)
;
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
School of Life Sciences and Technology, Tongji University(同济大学生命科学与技术学院)
One Token Per Frame: Reconsidering Visual Bandwidth in World Models for VLA Policy
每帧一个令牌:重新考虑世界模型中的视觉带宽
Zuojin Tang, Shengchao Yuan, Xiaoxin Bai, Zhiyuan Jing, De Ma, Gang Pan, Bin Liu
机构
*
Zhejiang University(浙江大学)
;
Central South University(中南大学)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Embodied Intelligence General Platform Laboratory, Chery Auto(奇瑞汽车 embodied intelligence 通用平台实验室)
;
E-surfing Digital Life Technology Co., Ltd., China Telecom(亿联数字生活技术有限公司,中国电信)