3D-Fixer: Coarse-to-Fine In-place Completion for 3D Scenes from a Single Image
3D-Fixer:从单张图像生成3D场景的粗到细就地补全
Ze-Xin Yin, Liu Liu, Xinjie Wang, Wei Sui, Zhizhong Su, Jian Yang, Jin Xie
机构
*
College of Computer Science, Nankai University(南开大学计算机科学学院)
;
School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)
;
Horizon Robotics(地平线机器人)
;
D-Robotics
机构
*
The University of Melbourne(墨尔本大学)
;
Tsinghua University(清华大学)
;
The University of New South Wales(新南威尔士大学)
;
Delft University of Technology(代尔夫特理工大学)
Diagonal-Tiled Mixed-Precision Attention for Efficient Low-Bit MXFP Inference
对角 tiled 混合精度注意力机制用于高效低比特 MXFP 推理
Yifu Ding, Xinhao Zhang, Jinyang Guo
机构
*
State Key Laboratory of Complex & Critical Software Environment (SKLCCSE), Beihang University(北京航空航天大学复杂关键软件环境国家重点实验室)
;
School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)
;
School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院)
;
Beijing Jiaotong University(北京交通大学)
ActivityForensics: A Comprehensive Benchmark for Localizing Manipulated Activity in Videos
活动取证:一种全面的基准,用于定位视频中的篡改活动
Peijun Bao, Anwei Luo, Gang Pan, Alex C. Kot, Xudong Jiang
机构
*
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院)
;
School of Computing and Artificial Intelligence, Jiangxi University of Finance and Economics(江西财经大学计算机与人工智能学院)
;
Jiangxi Provincial Key Laboratory of Multimedia Intelligent Processing(江西省多媒体智能处理重点实验室)
;
Faculty of Engineering, Shenzhen MSU-BIT University(深圳北理莫斯科大学工程系)
;
VinUniversity
Rethinking Position Embedding as a Context Controller for Multi-Reference and Multi-Shot Video Generation
重新思考位置嵌入作为多参考和多镜头视频生成的上下文控制器
Binyuan Huang, Yuning Lu, Weinan Jia, Hualiang Wang, Mu Liu, Daiqing Yang
机构
*
Wuhan University(武汉大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Hong Kong University of Science and Technology(香港科技大学)
;
Tsinghua University(清华大学)
机构
*
Xi’an Jiaotong University(西安交通大学)
;
South China University of Technology(华南理工大学)
;
Shenzhen Loop Area Institute(深圳河套学院)
;
Pazhou Laboratory(琶洲实验室)
Love Me, Love My Label: Rethinking the Role of Labels in Prompt Retrieval for Visual In-Context Learning
爱我,爱我的标签:重新思考标签在视觉上下文学习中的提示检索中的作用
Tianci Luo, Haohao Pan, Jinpeng Wang, Niu Lian, Xinrui Chen, Bin Chen, Shu-Tao Xia, Chun Yuan
机构
*
Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院)
Can Natural Image Autoencoders Compactly Tokenize fMRI Volumes for Long-Range Dynamics Modeling?
自然图像自编码器能否为长程动态建模紧凑地编码fMRI体积?
Peter Yongho Kim, Juhyeon Park, Jungwoo Park, Jubin Choi, Jungwoo Seo, Jiook Cha, Taesup Moon
机构
*
ECE, Seoul National University(首尔大学电气与计算机工程系)
;
IPAI, Seoul National University(首尔大学IPAI研究所)
;
BCS, Seoul National University(首尔大学生物与认知科学系)
;
Psychology, Seoul National University(首尔大学心理学系)
;
ASRI / INMC / AIIS, Seoul National University(首尔大学ASRI/INMC/AIIS研究所)