arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-24 至 2026-06-24 共收录 4 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4 篇

2606.24829 2026-06-24 cs.CV 新提交 79%

GeoT2V-Bench: Benchmarking 3D Consistency in Text-to-Video Models via 3D Reconstruction

GeoT2V-Bench: 通过3D重建基准测试文本到视频模型中的3D一致性

Chenrui Fan, Paolo Favaro

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 提出GeoT2V-Bench,通过3D重建评估相机提示的文本到视频模型能否支持刚性3D场景重建,揭示不同指标下的互补失效模式。

Comments 36 pages, 17 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14200 2026-06-24 cs.CV 版本更新 77%

Beyond a Single Light: A Large-Scale Aerial Dataset for Urban Scene Reconstruction Under Varying Illumination

超越单一光源:用于不同光照下城市场景重建的大规模航拍数据集

Zhuoxiao Li, Wenzong Ma, Taoyu Wu, Jinjing Zhu, Shuai Zhang, Jing OU, Tongyan Hua, Yinrui Ren, Rongjun Qin, Hui Xiong, Wufan Zhao

机构 * HKUST(GZ)(香港科技大学(广州)) University of Liverpool(利物浦大学) The Ohio State University(俄亥俄州立大学)

专题命中 三维重建 :Gaussian Splatting(abstract);3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 针对多时相航拍数据光照不一致导致的重建伪影问题,提出SkyLume大规模真实航拍数据集,包含10个城区超10万张高分辨率图像(四个倾斜视角和天底视角),每个区域在三个时段采集以隔离光照变化,并提供LiDAR扫描和3D真值,以及用于评估逆渲染鲁棒性的时间一致性系数(TCC)。

Comments ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24799 2026-06-24 cs.CV cs.AI 新提交 70%

OrbitForge: Text-to-3D Scene Generation via Reconstruction-Anchored Video Synthesis

OrbitForge: 通过重建锚定的视频合成实现文本到3D场景生成

Chenrui Fan, Paolo Favaro

机构 * Computer Vision Group, Institute of Computer Science University of Bern(计算机视觉组,计算机科学研究所,伯恩大学)

专题命中 三维重建 :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 提出OrbitForge,利用冻结的视频先验和每提示高斯泼溅重建优化,将单个文本生成视频转换为规范闭轨3D场景,无需任务特定微调或分数蒸馏。

Comments 40 pages, 33 figures, 19 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24282 2026-06-24 cs.CV 新提交 57%

UniRED: Unified RGB-D Video Frame Interpolation with Event Guidance

UniRED: 基于事件引导的统一RGB-D视频帧插值

Yinuo Zhang, Guangshun Wei, Yuanfeng Zhou, Yiran Shen

机构 * School of Software, Shandong University(山东大学软件学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出统一多模态框架UniRED,融合RGB外观、深度几何和事件时间线索,通过双向流估计与运动基细化实现高质量RGB-D视频帧插值,并构建RGB-D-Event数据集缓解数据稀缺。

详情

展开后加载摘要…

URL PDF HTML 收藏