arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-03 至 2026-07-03 共收录 13 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2603.28896 2026-07-03 cs.CV 版本更新 57%

Fisheye3R: Adapting Unified 3D Feed-Forward Foundation Models to Fisheye Lenses

Fisheye3R:将统一的3D前馈基础模型适应于鱼眼镜头

Ruxiao Duan, Erin Hong, Dongxu Zhao, Eric Turner, Alex Wong, Yunwen Zhou

机构 * Yale University(耶鲁大学) Google XR(谷歌XR)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出Fisheye3R框架,通过灵活学习方案在不退化性能的前提下,使多视角3D重建模型适应高径向畸变的鱼眼图像。

Comments European Conference on Computer Vision 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01204 2026-07-03 cs.CV 版本更新 57%

TabletopGen: Tabletop Scene Generation and Interactive Simulation for Robotic Manipulation

TabletopGen: 桌面场景生成与机器人操作的交互式仿真

Ziqian Wang, Yonghao He, Licheng Yang, Wei Zou, Hongxuan Ma, Liu Liu, Wei Sui, Yuxin Guo, Hu Su

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), Institute of Automation, Chinese Academy of Sciences(中国科学院多模态人工智能系统国家重点实验室) D-Robotics Horizon Robotics

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出TabletopGen,一种无需训练的全自动桌面场景生成与交互仿真引擎,通过实例提取、位姿对齐和物理仿真生成可交互场景,用于机器人操作数据合成。

Comments Project page: https://d-robotics-ai-lab.github.io/TabletopGen.project/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 3 篇

2410.01521 2026-07-03 cs.CV 版本更新 74%

MiraGe: Editable 2D Images using Gaussian Splatting

MiraGe: 使用高斯溅射的可编辑2D图像

Joanna Waczyńska, Tomasz Szczepanik, Piotr Borycki, Sławomir Tadeja, Thomas Bohné, Przemysław Spurek

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 提出MiraGe方法,利用镜面反射在3D空间中感知2D图像,并通过平面控制的高斯函数实现精确编辑,提升渲染质量并支持物理仿真修改。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24009 2026-07-03 cs.GR cs.AI cs.CV cs.LG cs.RO 版本更新 67%

Learning 3D-Gaussian Simulators from RGB Videos

从RGB视频学习3D高斯模拟器

Mikel Zhobro, Andreas René Geist, Georg Martius

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR、cs.RO

AI总结 提出3DGSim,一种从多视角RGB视频直接学习物理交互的3D模拟器,统一了3D场景重建、粒子动力学预测和视频合成,能泛化到未见过的多体交互和新场景编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29453 2026-07-03 cs.CV cs.AI cs.GR 版本更新 62%

Resonant Brane Splatting for Arbitrary-Scale Super-Resolution

用于任意尺度超分辨率的共振膜片溅射

Giulio Federico, Giuseppe Amato, Claudio Gennaro, Fabio Carrara, Marco Di Benedetto

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 提出共振膜片溅射(RBS)框架,用Brane基元替代高斯溅射,通过高斯-埃尔米特模式捕获高频细节,实现任意尺度超分辨率的高质量与高效渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 4 篇

2605.09604 2026-07-03 cs.CV 版本更新 57%

DAP: Doppler-aware Point Network for Heterogeneous mmWave Action Recognition

DAP:面向异构毫米波的点网络用于人类动作识别

Jiaying Lin, Shiman Wu, Jinfu Liu, Can Wang, Mengyuan Liu

机构 * Peking University(北京大学) Huazhong University of Science and Technology(华中科技大学) DJI Technology Company Ltd.(大疆技术创新有限公司) Christian-Albrechts-Universität zu Kiel(基尔大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出DAP-Net,通过异构雷达源的跨模态对齐和D2R模块实现点云增强,提升动作识别的鲁棒性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14421 2026-07-03 cs.RO 版本更新 57%

BIEVR-LIO: Robust LiDAR-Inertial Odometry through Bump-Image-Enhanced Voxel Maps

BIEVR-LIO:通过凸起图像增强体素地图实现鲁棒的激光雷达惯性里程计

Patrick Pfreundschuh, Turcan Tuna, Cedric Le Gentil, Roland Siegwart, Cesar Cadena, Helen Oleynikova

机构 * 1 Autonomous Systems Lab, ETH Z\"urich, Switzerland, 2 Robotic Systems Lab, ETH Z\"urich, Switzerland, 3 Mobile Robotics Lab, ETH Z\"urich, Switzerland -1.5mm

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出BIEVR-LIO方法,通过高分辨率体素地图表示和信息导向点采样策略,提升在信息稀疏环境下的激光雷达惯性里程计鲁棒性,并在多种场景中实现优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10816 2026-07-03 cs.CV 版本更新 57%

Occlusion-Aware 3D Hand-Object Pose Estimation with Masked AutoEncoders

基于掩码自编码器的遮挡感知3D手-物体姿态估计

Hui Yang, Wei Sun, Jian Liu, Jin Zheng, Jian Xiao, Ajmal Mian

机构 * National Engineering Research Center for Robot Visual Perception and Control Technology, School of Artificial Intelligence and Robotics, Hunan University(国家机器人视觉感知与控制技术工程研究中心,人工智能与机器人学院,湖南大学) School of Architecture and Art, Central South University(建筑与艺术学院,中南大学) Department of Computer Science and Software Engineering, The University of Western Australia(计算机科学与软件工程系,西澳大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出HOMAE方法,通过目标聚焦掩码策略和隐式SDF与显式点云融合,解决手-物体交互中的严重遮挡问题,在DexYCB和HO3Dv2上达到最优性能。

Comments IEEE Transactions on Multimedia 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04357 2026-07-03 math.AT 版本更新 50%

Circular Max-Flow for Periodic Data via Reeb Graphs

基于Reeb图的周期数据环形最大流

Matteo Pegoraro, Lisbeth Fajstrup

专题命中 点云 :point cloud(abstract)

AI总结 针对周期性边界条件数据,利用Reeb图将空间几何简化为有向一维隧道网络,并引入容量约束定义环形最大流,通过线性优化求解,无需指定进出口。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 新视角合成 1 篇

2604.01761 2026-07-03 cs.CV 版本更新 77%

Control-DINO: Feature Space Conditioning for Controllable Image-to-Video Diffusion

Control-DINO:用于可控图像到视频扩散的特征空间条件

Edoardo A. Dominici, Thomas Deixelberger, Konstantinos Vardis, Markus Steinberger

机构 * Huawei Technologies, Switzerland(华为技术(瑞士)) Huawei Technologies, Austria(华为技术(奥地利)) Graz University of Technology, Austria(格拉茨技术大学)

专题命中 新视角合成 :point cloud(abstract);novel view synthesis(abstract);3D generation(abstract);分类 cs.CV

AI总结 本文提出Control-DINO,通过解耦外观与其他特征,实现对视频扩散模型的可控生成,提升生成渲染的可控性。

Comments ECCV 2026 - Project Page https://dedoardo.github.io/projects/control-dino/

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 3D生成 1 篇

2601.12770 2026-07-03 cs.CV 版本更新 57%

One-Shot Feed-Forward 360$^{\circ}$ Animatable Avatar via Inpainted UV-Space Gaussian Modeling

通过修补UV空间高斯建模的一次前馈360度可动画化头像

Shuling Zhao, Dan Xu

机构 * The Hong Kong University of Science and Technology(香港科技大学) Zeekr Automobile R&D Co., Ltd(Zeekr汽车研发有限公司)

专题命中 3D生成 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种基于UV空间高斯建模的一次前馈框架,利用预训练3D GAN的先验知识修补缺失区域,实现360度全头可动画化头像的高质量重建与实时动画。

Comments Accepted by ECCV 2026. Project page: https://shaelynz.github.io/fhavatar/

详情

展开后加载摘要…

URL PDF HTML 收藏

6. SLAM与定位 1 篇

2603.19013 2026-07-03 cs.CV 版本更新 57%

GenHOI: Generalized Hand-Object Pose Estimation with Occlusion Awareness

GenHOI:具有遮挡意识的通用手-物体姿态估计

Hui Yang, Wei Sun, Jian Liu, Jian Xiao, Tao Xie, Hossein Rahmani, Ajmal Saeed Mian, Nicu Sebe, Gim Hee Lee

机构 * Hunan University(湖南大学) Lancaster University(兰卡斯特大学) University of Western Australia(西澳大学) University of Trento(特伦托大学) National University of Singapore(新加坡国立大学)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 本文提出GenHOI框架,通过整合层次语义知识与手部先验,提升在遮挡条件下手-物体姿态估计的泛化能力,实验表明在DexYCB和HO3Dv2基准上达到SOTA性能。

Comments European Conference on Computer Vision (ECCV), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他3D视觉 1 篇

2606.30313 2026-07-03 cs.CV cs.LG 版本更新 57%

TRACE: A Concept Bottleneck Model for Longitudinal 3D Glioblastoma Response Assessment

TRACE:用于纵向3D胶质母细胞瘤反应评估的概念瓶颈模型

Alia Tarek, Hamsa Saberr, Hamza Elghonemy, Youssef Afify, Tamer Basha, Omair Shahzad Bhatti, Abdulrahman M. Selim, Hasan Md Tusfiqur Alam, Daniel Sonntag

机构 * Department of Biomedical and Healthcare Data Engineering, Faculty of Engineering, Cairo University(生物医学与健康数据工程系,工程学院,开罗大学) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI)) University of Oldenburg(奥尔登堡大学)

专题命中 其他3D视觉 :3D vision(abstract);分类 cs.CV

AI总结 提出TRACE模型,通过概念瓶颈架构将RANO 2.0标准融入深度学习,实现可解释的4类胶质母细胞瘤纵向反应分类,在LUMIERE数据集上达到4类宏F1为0.4769,并支持概念校正。

Comments Accept in the EXPLIMED: Explainable Artificial Intelligence for the Medical Domain workshop in IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏