arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-01 至 2026-06-01 共收录 3 信号源:cs.CV, cs.GR, cs.RO

1. 新视角合成 3 篇

2605.31535 2026-06-01 cs.CV cs.AI cs.LG 79%

RayDer: Scalable Self-Supervised Novel View Synthesis from Real-World Video

RayDer: 从真实世界视频中可扩展的自监督新视角合成

Ulrich Prestel, Stefan Andreas Baumann, Nick Stracke, Björn Ommer

机构 * Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心 (MCML))

专题命中 新视角合成 :novel view synthesis(title,abstract);分类 cs.CV

AI总结 提出统一前馈变压器RayDer,将相机估计、场景重建和渲染整合为单一骨干,实现自监督新视角合成的可扩展幂律缩放,在零样本开放集性能上媲美有监督方法。

Comments Project Page: https://compvis.github.io/rayder

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30469 2026-06-01 cs.SD cs.CV 74%

3DAE: Binaural Quality Assessment for Audio Novel View Synthesis with Spatial Maps and Benchmark

3DAE: 基于空间图谱和基准的音频新视角合成双耳质量评估

Jialu Xu, Yifan Zhou

机构 * University of Waterloo(滑铁卢大学)

专题命中 新视角合成 :novel view synthesis(title);分类 cs.CV

AI总结 提出一个全参考诊断框架3DAE Map,通过时频音频误差图(幅度、ILD、IPD、时间对齐、响度和高频故障)进行视觉检查,并构建模型无关基准3DAE Bench,用于评估音频新视角合成模型的双耳预测质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24700 2026-06-01 cs.CV cs.GR 62%

SRUG: Shadow-Guided Relightable Urban Scene with Generation Model

SRUG: 基于阴影引导的可重光照城市场景生成模型

Yonghao Zhao, Zexin Yin, Jian Yang, Beibei Wang, Jin Xie

机构 * College of Computer Science, Nankai University(南开大学计算机科学学院) Nankai University(南开大学) Nanjing University(南京大学) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV、cs.GR

AI总结 提出SRUG框架,利用阴影引导3D补全模型恢复不可见区域几何,结合迭代材质分解和物理光照模型,实现从稀疏输入视图生成可重光照城市场景。

详情

展开后加载摘要…

URL PDF HTML 收藏