Hard to See, Hard to Label: Generative and Symbolic Acquisition for Subtle Visual Phenomena
难以察觉,难以标注:生成与符号获取用于微妙的视觉现象
Renjith Prasad, Rishabh Sharma, Andrew E. Shao, Annmary Justine Koomthanam, Shreyas Kulkarni, Suparna Bhattacharya, Martin Foltin, Amit Sheth, David Orozco, Matthew Quinn, Brian Sammuli
机构
*
University of South Carolina(南卡罗来纳大学)
;
AI Research Lab, HPE Labs, Hewlett Packard Enterprise(HPE实验室人工智能研究部)
;
Indian AI Research Organization(印度人工智能研究组织)
;
General Atomics(通用原子公司)
Gesture2Music: A Low-Latency Real-Time Framework for Continuous Gesture-Driven Music Generation
Gesture2Music: 一种低延迟的实时框架,用于连续的手势驱动音乐生成
Rathinaraja Jeyaraj, Barathi Subramanian, Kapilya Gangadharan, Anand Paul
机构
*
Stanford University(斯坦福大学)
;
Saveetha Institute of Medical and Technical Sciences(Saveetha医学与技术科学学院)
;
LSU Health Sciences Center New Orleans(路易斯安那州立大学健康科学中心新奥尔良分校)
High-Precision Dichotomous Image Segmentation via Depth Integrity-Prior and Fine-Grained Patch Strategy
通过深度完整性先验和细粒度补丁策略实现高精度二元图像分割
Xianjie Liu, Keren Fu, Qijun Zhao
机构
*
College of Computer Science, Sichuan University(四川大学计算机学院)
;
National Key Lab of Fundamental Science on Synthetic Vision, Sichuan University(合成视觉基础科学国家实验室)
机构
*
Department of Computational and Data Sciences (CDS)(计算与数据科学系)
;
Robert Bosch Center for Cyber Physical Systems (RBCCPS)(罗伯特·博世中心(RBCCPS))
;
Center of Data for Public Good (CDPG)(公共数据中心(CDPG))
;
Centre for Infrastructure, Sustainable Transportation & Urban Planning (CiSTUP)(基础设施、可持续交通与城市规划中心(CiSTUP))
;
Indian Institute of Science, Bengaluru, India(印度科学研究院,班加罗尔,印度)
CLLAP: Contrastive Learning-based LiDAR-Augmented Pretraining for Enhanced Radar-Camera Fusion
CLLAP:基于对比学习的激光雷达增强预训练用于增强雷达-相机融合
Bingyi Liu, Chuanhui Zhu, Hongfei Xue, Jian Teng, Jipeng Liu, Enshu Wang, Penglin Dai, Pu Wang
机构
*
Wuhan University of Technology(武汉理工大学)
;
University of North Carolina at Charlotte(北卡罗来纳州立大学)
;
Wuhan University(武汉大学)
;
Southwest Jiaotong University(西南交通大学)
;
The Hong Kong Polytechnic University(香港理工大学)
FunRec: Reconstructing Functional 3D Scenes from Egocentric Interaction Videos
FunRec:从第一人称交互视频重建功能3D场景
Alexandros Delitzas, Chenyangguang Zhang, Alexey Gavryushin, Tommaso Di Mario, Boyang Sun, Rishabh Dabral, Leonidas Guibas, Christian Theobalt, Marc Pollefeys, Francis Engelmann, Daniel Barath
机构
*
ETH Zurich(苏黎世联邦理工学院)
;
Max Planck Institute for Informatics(马克斯·普朗克研究所(信息学))
;
Stanford University(斯坦福大学)
;
Microsoft(微软)
;
USI Lugano(USI卢加诺)
机构
*
Sun Yat-sen University(中山大学)
;
Shandong University(山东大学)
;
Guangdong Province Key Laboratory of Information Security Technology(广东省信息安全技术重点实验室)
;
Key Laboratory of Machine Intelligence and Advanced Computing, Ministry of Education, China(教育部机器智能与先进计算重点实验室)