arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

2026-07-17 至 2026-07-17 共收录 2
2605.30060 2026-07-17 cs.CV 版本更新

Towards Consistent Video Geometry Estimation

Towards Consistent Video Geometry Estimation

Zhu Yu, Jingnan Gao, Runmin Zhang, Lingteng Qiu, Zhengyi Zhao, Rui Peng, Yichao Yan, Kejie Qiu, Siyu Zhu, Zilong Dong, Si-Yuan Cao, Hui-Liang Shen

机构 * Zhejiang University(浙江大学) Tongyi Lab, Alibaba Group(阿里云实验室) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学)

AI总结 提出ViGeo,一种基于纯Transformer架构的前馈基础模型,通过动态分块注意力机制和基于补全的数据精炼框架,实现视频序列中空间密集且时间一致的几何(深度、法线、点图)估计,在在线、离线及长视频任务中达到最先进性能。

Comments Project webpage: https://pkqbajng.github.io/ViGeo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19474 2026-07-17 cs.CV 版本更新

DINO-SLAM: DINO-informed RGB-D SLAM for Neural Implicit and Explicit Representations

DINO-SLAM:用于神经隐式和显式表示的基于DINO的RGB-D SLAM

Ziren Gong, Xiaohan Li, Fabio Tosi, Youmin Zhang, Stefano Mattoccia, Jun Wu, Matteo Poggi

机构 * University of Bologna, Italy(博洛尼亚大学) Faculty of Dentistry, The University of Hong Kong, China(香港大学牙科学院) Rawmantic AI, China(Rawmantic AI) Fudan University, Shanghai, China(复旦大学)

AI总结 研究提出DINO-SLAM,通过DINO增强SLAM系统隐式与显式表示。利用场景几何编码器将DINO特征变为几何感知特征,在此基础上为NeRF和GS SLAM系统提出两种范式,相比现有方法在多个数据集上性能更优。

详情

展开后加载摘要…

URL PDF HTML 收藏