arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 21 信号源:cs.CV, cs.GR, cs.RO

1. 新视角合成 21 篇

2606.25427 2026-06-25 cs.CV 新提交 90%

Gastroendoscopy View Synthesis: A New Real Dataset and Evaluation

胃内镜视图合成:一个新的真实数据集与评估

Masaki Minai, Yusuke Monno, Masatoshi Okutomi, Sho Suzuki

机构 * Department of Systems and Control Engineering, School of Engineering, Institute of Science Tokyo(东京科学大学工学院系统与控制工程系) Department of Gastroenterology, International University of Health and Welfare Ichikawa Hospital(国际医疗福祉大学市川医院消化内科)

专题命中 新视角合成 :3DGS(summary_cn,abstract);NeRF(abstract,abstract_cn);Gaussian Splatting(abstract);point cloud(abstract)

AI总结 为解决胃内镜新视角合成数据集不足的问题,提出首个真实胃镜数据集GastroNVS,并评估多种3DGS方法,为未来发展指明挑战。

Comments Accepted for EMBC 2026. Project page: http://www.ok.sc.e.titech.ac.jp/res/GastroNVS/GastroGS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20531 2026-06-19 cs.CV 新提交 90%

VisDom: Sparse Novel View Synthesis with Visible Domain Constraint

VisDom: 具有可见域约束的稀疏新视角合成

Mariia Gladkova*, Tarun Yenamandra*, Edmond Boyer, Robert Maier, Tony Tung, Daniel Cremers

机构 * TU Munich(慕尼黑工业大学) MCML(慕尼黑机器学习中心)

专题命中 新视角合成 :NeRF(summary_cn,abstract);novel view synthesis(title,abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出VisDom,一种无学习的几何约束,通过最小多视角可见性要求增强视觉外壳重建,作为稀疏新视角合成中的空间先验,集成到NeRF和GS管线中,从四张输入图像实现高质量重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27071 2026-07-10 cs.CV 新提交 89%

PanoImager: Geometry-Guided Novel View Synthesis and Reconstruction from Sparse Panoramic Views

PanoImager:基于几何引导的稀疏全景视图新视角合成与重建

Zhisong Xu, Takeshi Oishi

机构 * Institute of Industrial Science, The University of Tokyo(东京大学生产技术研究所)

专题命中 新视角合成 :3DGS(summary_cn,abstract);novel view synthesis(title);3D reconstruction(abstract);分类 cs.CV

AI总结 提出PanoImager框架,无需SfM,结合前馈位姿/深度先验、几何条件扩散视图补全和深度引导3DGS优化,从稀疏全景图像实现稳定新视角合成与重建。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22147 2026-07-27 cs.CV 新提交 85%

Visual Relocalization from Sparse Views in Aliased and Low-Texture Environments via Novel View Synthesis

通过新视图合成在别名和低纹理环境中从稀疏视图进行视觉重定位

Maria Peribañez, Javier Civera, Rudolph Triebel, Riccardo Giubilato

机构 * University of Zaragoza(萨拉戈萨大学) German Aerospace Center (DLR)(德国航空航天中心) Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工学院)

专题命中 新视角合成 :novel view synthesis(title);3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对类行星地形中视觉定位难题,提出基于 3D 高斯溅射构建可微地图表示估计相机姿态的方法,采用结合光度与几何损失的几何感知训练策略,经实验验证能有效提升定位准确性与姿态估计鲁棒性。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05243 2026-07-07 cs.CV 新提交 84%

GUSH3R: Everyone Everywhere All at Once as Gaussians

GUSH3R:将各处所有人物统一表示为高斯体的方法

Keito Abe, Kaede Shiohara, Takashi Otonari, Toshihiko Yamasaki

机构 * The University of Tokyo(东京大学)

专题命中 新视角合成 :Gaussian Splatting(abstract);3DGS(abstract);3D reconstruction(abstract);point cloud(abstract)

AI总结 该研究面向单目视频动态人-场景重建难题,提出前馈框架GUSH3R,单次前向即可输出几何一致的3D高斯基元,兼顾新视角渲染质量与推理效率。

Comments Project page: https://abkeito.github.io/gush3r-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23027 2026-06-26 cs.CV 新提交 83%

Learning Stable Canonical Worlds for Novel View Synthesis and Beyond

学习稳定规范世界用于新视角合成及更多应用

Xiaoyu Xu, Jian Zou, Sheyang Tang, Zhihua Wang, Jing Liao, Kede Ma

机构 * City University of Hong Kong(香港城市大学) University of Waterloo(滑铁卢大学)

专题命中 新视角合成 :novel view synthesis(title,abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出CanonicalGS,一种前馈高斯泼溅管道,通过不确定性感知融合将多视图观测映射到稳定场景表示,提升新视角合成质量并迁移到下游视觉任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15271 2026-07-17 cs.CV cs.GR cs.LG 新提交 81%

Online Neural Space Time Memory for Dynamic Novel View Synthesis

用于动态新视角合成的在线神经时空记忆

Baback Elmieh, Lynn Tsai, Zeman Li, Srinivas Kaza, Tiancheng Sun, Gabor Csapo, Ali Behrouz, Yuan Deng, Stephen Lombardi, Steven M. Seitz, Xuan Luo

机构 * University of Washington(华盛顿大学) Google(谷歌)

专题命中 新视角合成 :novel view synthesis(title,abstract);分类 cs.CV、cs.GR

AI总结 研究多视图流视频在线新视角合成问题,提出解耦记忆更新与应用频率的方法,通过跨视图注意力管理变形,引入辅助记忆损失和记忆缓存策略,实现实时、领先性能及微小尺度在线记忆。

Comments 15 pages. Preprint. Project page with demos and video results: https://nst-mem.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12442 2026-08-14 cs.CV 新提交 79%

MV2: Multi-View Multi-Vehicle Driving Dataset for Novel View Synthesis

MV2:用于新视角合成的多视角多车辆驾驶数据集

Sanjay Bhargav Dharavath, Hanvitha Saraswathi Mukkamala, Faizan Farooq Khan, Ioannis Kakogeorgiou, Aditya Arun, C V Jawahar, Zakaria Laskar

机构 * International Institute of Information Technology, Hyderabad(海得拉巴国际信息技术学院) King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学) IIT, National Centre for Scientific Research “Demokritos”(德谟克利特国家科学研究中心 IIT) Adobe MDSR, India(奥多比印度MDSR部门) Indian Institute of Science Education and Research, Thiruvananthapuram(特里凡得琅印度科学教育与研究学院)

专题命中 新视角合成 :novel view synthesis(title,abstract);分类 cs.CV

AI总结 针对驾驶场景新视角合成的难题,提出含50个场景12000张图像的MV2多车辆数据集,经严格配准验证,基准测试显示视角差异增大NVS性能下降,前馈位姿估计器弱于优化方法。

Comments 18 pages, 7 figures, ECCV accepted paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31258 2026-07-01 cs.CV 新提交 77%

WarpHammer: Densifying Scene Warps with 3D Object Priors for Extreme View Synthesis

WarpHammer: 利用3D物体先验稠密化场景扭曲以实现极端视角合成

Michael Green, Gavriel Habib, Dvir Samuel, Tal Berkovitz Shalev, Issar Tzachor, Rami Ben-Ari, Or Litany

机构 * OriginAI, Israel(OriginAI,以色列) NVIDIA(英伟达) Technion(以色列理工学院)

专题命中 新视角合成 :3D reconstruction(abstract);point cloud(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 针对投影条件新视角合成在大轨道运动下扭曲稀疏导致生成失败的问题,提出无需训练的WarpHammer框架,通过引入3D生成先验的物体显式重建来补充缺失前景并遮挡不应可见的背景点,恢复外观和相机线索,并首次支持融合外部辅助物体视图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02372 2026-07-03 cs.CV 新提交 74%

Learning Spectral and Polarimetric Clues for One-to-Multimodal Novel View Synthesis

学习光谱和偏振线索用于一对多模态新视角合成

Federico Lincetto, Gianluca Agresti, Mattia Rossi, Piergiorgio Sartor, Pietro Zanuttigh

机构 * MEDIA Lab(媒体实验室) University of Padova(帕多瓦大学) Sony EUISPC(索尼欧洲影像处理中心) Sony Semiconductor Solutions Europe(索尼半导体解决方案欧洲分公司)

专题命中 新视角合成 :novel view synthesis(title);分类 cs.CV

AI总结 提出SPoILeR方法,通过多模态预训练学习模态间相关性,在仅RGB监督下实现未见场景的多模态新视角渲染。

Comments Accepted at ECCV 2026. Project page: https://medialab.dei.unipd.it/paper_data/SPoILeR/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12635 2026-06-12 cs.CV 新提交 74%

CD-RCM: Generalizable Continuous-Depth Novel View Synthesis for Reflectance Confocal Microscopy

CD-RCM:面向反射共聚焦显微镜的泛化连续深度新视角合成

Tooba Imtiaz, Milind Rajadhyaksha, Kivanc Kose, Jennifer Dy

机构 * Northeastern University(东北大学) Memorial Sloan Kettering Cancer Center(纪念斯隆凯特琳癌症中心)

专题命中 新视角合成 :novel view synthesis(title);分类 cs.CV

AI总结 针对反射共聚焦显微镜各向异性3D体积,提出首个RCM专用新视角合成方法CD-RCM,通过前馈模型从稀疏z-stack预测连续深度切片,实现亚秒级高保真合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19765 2026-07-23 cs.CV 新提交 70%

Extending a Large View Synthesis Model for Multi-view Panoptic Segmentation

扩展用于多视图全景分割的大视图合成模型

Kwonyoung Ryu, In-Jae Lee, Jonghyun Jin, Hyunjee Lee, Jongmin Lee, Jaesik Park

机构 * POSTECH(浦项科技大学) POSCO DX(浦项制铁DX公司) Chung-Ang University(中央大学) Seoul National University(首尔国立大学)

专题命中 新视角合成 :3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 研究将大视图合成模型从外观渲染扩展到3D场景理解,提出复用冻结模型传播全景标签的分割管道,无需3D重建和特定训练,在ScanNet和Replica数据集上实验,分割质量佳且新视图合成表现优。

Comments Accepted to ECCV 2026. 31 pages, 7 figures, 9 tables. Project page: https://kwonyoung9120.github.io/PanopticLVSM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19731 2026-07-23 cs.GR cs.ET cs.MM eess.IV eess.SP 新提交 70%

Fast Wave-optics Rendering of Multiplane Images for 3D Holographic Displays

用于3D全息显示的多平面图像快速波光学渲染

Brian Chao, Dario Seyb, Nathan Matsuda, Oliver Cossairt, Yang Zhou, Douglas Lanman, Gordon Wetzstein, Grace Kuo, Changwon Jang

专题命中 新视角合成 :3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.GR

AI总结 针对神经渲染在2D设备上查看限制感知真实感问题,提出基于多平面图像的波光学渲染管道,该算法在运行时大幅超越现有算法,速度提升显著,且图像质量优,经多数据集验证性能出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02301 2026-07-03 cs.CV 新提交 70%

InvSplat: Inverse Feed-Forward Scene Splatting

InvSplat: 逆前馈场景高斯泼溅

Polina Karpikova, Wenjing Bian, Haofei Xu, Hendrik Lensch, Andreas Geiger

专题命中 新视角合成 :3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 提出一种前馈多视图重建框架,直接预测具有材质属性的结构化3D高斯表示,实现几何与反射率的联合估计,支持重光照和新视角合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01962 2026-07-03 cs.CV cs.AI cs.GR cs.RO 新提交 67%

NeoMap: Training-free Novel-View Synthesis from Single Images and Videos

NeoMap: 无需训练的单图像和视频新视角合成

Jinxi Li, Tianyi Zhang, Yafei Yang, Zihui Zhang, Peng Huang, Koon Wing Macgyver Lin, Bo Yang

机构 * Shenzhen Research Institute, The Hong Kong Polytechnic University(香港理工大学深圳研究院) vLAR Group, The Hong Kong Polytechnic University(香港理工大学vLAR实验室)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV、cs.GR、cs.RO

AI总结 提出NeoMap,一种无需训练的框架,通过收敛流形交替投影迭代优化初始噪声,从预训练视频模型中定位高保真、视角一致的新视角解,在多个基准上达到最优。

Comments ECCV 2026. Jinxi and Tianyi are co-first authors. Code and data are available at: https://github.com/vLAR-group/NeoMap

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15951 2026-07-20 cs.GR cs.CV cs.DC 新提交 66%

Rendering 3D Gaussians on a Graph Processor

在图形处理器上渲染3D高斯分布

Nicholas Fry, Ignacio Alzugaray, Mark Pupilli, Paul H. J. Kelly, Andrew J. Davison

机构 * Imperial College London Department of Computing(伦敦帝国学院计算机系)

专题命中 新视角合成 :3DGS(abstract,comments);分类 cs.CV、cs.GR

AI总结 研究在IPU上实现3D高斯渲染器,输入为3D高斯地图,通过特定模式路由高斯基元,遵循BSP模型计算。评估了仅用SRAM实现的瓶颈及对性能和质量的影响,还探讨了对GPU和相关架构的意义。

Comments Project page: https://nmjfry.github.io/ipu-3dgs/

Journal ref Eurographics Symposium on Rendering (Symposium Track), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31679 2026-07-01 cs.GR cs.CV 新提交 62%

Practical High-Fidelity Novel-View Synthesis of Mounted Lepidoptera

实用高保真新视角合成:鳞翅目针插标本

Kristof Overdulve, Lode Jorissen, Nick Michiels

机构 * Digital Future Lab, Flanders Make, Hasselt University(数字未来实验室,弗兰德斯制造,哈瑟尔特大学)

专题命中 新视角合成 :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 针对鳞翅目针插标本微小脆弱、景深有限及腹面拍摄困难的问题,提出结合手持焦点堆叠、非接触第一表面镜系统和无分割镜面感知3D高斯泼溅的端到端管线,实现高保真3D重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07320 2026-07-09 cs.CV 新提交 57%

SoccerNet 2026 Challenges Results

SoccerNet 2026挑战结果

Anthony Cioppa, Silvio Giancola, Håkan Ardö, Mohamad Dalal, Jan Held, Jérémie Ochin, Jiayuan Rao, Karen Sanchez, Renaud Vandeghen, Artur Xarles, Olivier Barnich, Albert Clapés, Mathieu Delvaux, Sergio Escalera, Bernard Ghanem, Cédric Hons, Antoine Houet, Sotiris Manitsaris, Tom Michel, Pierre Miralles, Thomas B. Moeslund, Mikael Nilsson, Bogdan Stanciulescu, Marc Van Droogenbroeck, Yanfeng Wang, Weidi Xie, Faisal Altawijri, Mohamed Atef, Semen Budennyy, Vasiliy Chelpanov, Puhua Chen, Yixin Chen, Lechao Cheng, Jianling Chu, Ju-Seong Do, Oleg Durygin, Omar Fetouh, Mirco Fuchs, Youssef Ghallab, Falguni Ghosh, Wonjun Heo, Yufeng Hu, Weixuan Huang, Phuong-Linh Huynh-Ha, Matvey Isupov, Yangguang Ji, Siyuan Jiang, Zhenxiang Jiang, Wonyong Jo, Ho-Young Jung, SeongHeon Kang, MinJae Kim, Youngseon Kim, Jakub Komosa, Artem Konshin, Trung-Hoang Le, Jongmin Lee, Lingling Li, Litao Li, Vadim Linkov, Fang Liu, Haoxuan Ma, Shun Makino, Ismail Mathkour, Konstantin Mitin, Mikhail Moiseev, Takumi Nagaya, Yuki Nakamura, Thanh-Khoi Nguyen, Hoang-Phuc Nguyen, Trong-Thuan Nguyen, Christian Orduz, Kwanyong Park, Fabian Perez, Parthsarthi Rawat, SuHyun Rim, Hoover Rueda-Chacón, Atom Scott, Minori Sugimura, Yuyang Sun, Shengeng Tang, Minh-Triet Tran, Ikuma Uchida, Juan Vanegas, Thanh-Nhan Vo, Jiangtao Wang, Yaxiong Wang, Xiaogang Wang, Ruifeng Wang, Rio Watanabe, Jiali Wen, Yongliang Wu, Di Yang, Xu Yang, Zhuo Yang, Xinyu Ye, Yibo Yu, Zihan Zhai, Yu Zhang, Zhenyu Zhao, Zhun Zhong, Yixi Zhou, Xingyu Zhu, Wenbo Zhu, Julian Ziegler

机构 * University of Liège(列日大学) King Abdullah University of Science and Technology(阿卜杜拉国王科技大学) Spiideo(斯皮迪奥公司) Aalborg University(奥尔堡大学) SpAItial(斯帕蒂亚尔公司) Center for Robotics, Mines Paris, PSL(巴黎矿业学院机器人中心(巴黎文理研究大学)) Footovision(Footovision公司) Shanghai Jiao Tong University(上海交通大学) Universitat de Barcelona(巴塞罗那大学) Computer Vision Center(计算机视觉中心) EVS Broadcast Equipment(EVS广播设备公司) Pioneer Center for Artificial Intelligence(先锋人工智能中心) Lund University(隆德大学) TAHAKOM(TAHAKOM公司) Mohamed Bin Zayed University for Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学) Sber AI(Sber人工智能公司) Salute For Business(Salute For Business公司) Intelligent Perception and Image Understanding Lab, Xidian University(西安电子科技大学智能感知与图像理解实验室) South China University of Technology(华南理工大学) Hefei University of Technology(合肥工业大学) Kyungpook National University(庆北国立大学) Leipzig University of Applied Sciences(莱比锡应用科学大学) Friedrich-Alexander University Erlangen-Nuremberg(埃尔朗根-纽伦堡大学) University of Seoul(首尔大学) Shenzhen Institute for Advanced Study, University of Electronic Science and Technology of China(电子科技大学深圳高等研究院) Nanjing University(南京大学) University of Science, Ho Chi Minh City(胡志明市科技大学) Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 SoccerNet 2026挑战涵盖五项体育视频理解视觉任务,为每项任务提供数据、协议和基线。众多团队参与,本文介绍任务、评估协议,展示排行榜并总结领先提交内容,记录各任务当前状态。

Comments 40 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02712 2026-07-07 cs.CV 新提交 57%

Global Pose Control for Generative View Synthesis in Normalized Object Coordinate Space

归一化物体坐标空间中用于生成视图合成的全局姿态控制

Zhibing Li, Amogh Gupta, Behnoosh Parsa, Dan Casas

机构 * The Chinese University of Hong Kong(香港中文大学) Amazon(亚马逊)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 针对现有生成模型在目标视图全局控制上的不足,提出在归一化物体坐标空间中精确相机控制的新方法,以单张或少量无姿态图像为输入,将视图合成视为图像编辑问题,提升了视图生成质量和保真度。

Comments Accepted to ECCV 2026. Project page https://lizb6626.github.io/GlobalNVS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31585 2026-07-01 cs.CV cs.AI 新提交 57%

DPPE: Rethinking Camera-Based Positional Encoding for Scaling Multi-View Transformers

DPPE:重新思考基于相机的可缩放多视图Transformer的位置编码

Shun Kenney, Teppei Suzuki

机构 * Keio University(庆应义塾大学) SB Intuitions

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 针对多视图Transformer中基于相机参数的位置编码导致训练后期性能停滞的问题,提出解耦位姿位置编码(DPPE),将旋转和平移显式分离,实现稳定长训练并提升外推泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27575 2026-06-29 cs.CV 新提交 57%

Perceptual 3D Simulation With Physical World Modeling

基于物理世界建模的感知3D仿真

Wanhee Lee, Klemen Kotar, Rahul Mysore Venkatesh, Jared Watrous, Daniel L. K. Yamins

机构 * Stanford University(斯坦福大学)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 提出P3Sim系统,结合学习型物理世界模型、几何条件模块和持久场景记忆,在部分观测和不完整3D变换信号下模拟未来场景状态,实现多任务泛化。

Comments Published as a conference paper at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏