Audio-Visual Camera Pose Estimation with Passive Scene Sounds and In-the-Wild Video
利用被动场景声音和真实世界视频进行音频-视觉相机姿态估计
机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)
AI总结 本文提出一种结合方向到达谱和双耳嵌入的音频-视觉框架,用于真实世界视频中的相机姿态估计,在视觉信息受损时表现出鲁棒性。
Comments ECCV 2026
高校专区
利用被动场景声音和真实世界视频进行音频-视觉相机姿态估计
机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)
AI总结 本文提出一种结合方向到达谱和双耳嵌入的音频-视觉框架,用于真实世界视频中的相机姿态估计,在视觉信息受损时表现出鲁棒性。
Comments ECCV 2026
NI-Tex: 基于非等距图像的服装纹理生成
机构 * Zhejiang University(浙江大学) ; Shanghai Innovation Institute(上海创新研究院) ; Westlake University(西湖大学) ; University of Texas at Austin(德克萨斯大学奥斯汀分校) ; Fudan University(复旦大学)
AI总结 针对非等距图像与3D服装网格间的纹理生成问题,提出结合物理模拟数据集、非等距图像编辑和迭代烘焙的框架,生成高质量PBR纹理。
Comments Accepted to CVPR 2026 (Highlight)
单调随机优化的半强盗学习
机构 * Indian Institute of Technology Bombay(印度理工学院孟买分校) ; University of Texas at Austin(德克萨斯大学奥斯汀分校) ; University of Michigan(密歇根大学)
AI总结 针对未知分布下的单调随机优化问题,提出一种半强盗在线学习算法,在仅观测被探测变量样本的情况下,实现相对于最优近似算法的√(T log T)遗憾界,并扩展到删失和二元反馈场景。
Comments Full version (and extension) of FOCS 2024 paper. Fixes some missing assumptions in our results for continuous distributions. Also adds extensions to censored and binary feedback settings (along with applications) Revision: We improved the $k$ dependence