arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 74 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 74 篇

2607.07168 2026-07-20 cs.CV 版本更新 87%

NoDrift3R: Raymap-Guided Coupling for Drift-Robust Unposed Feed-Forward 3D Reconstruction

NoDrift3R:用于无漂移前馈3D重建的光线图引导耦合

Xiangyu Sun, Liu Liu, Seungkwon Yang, Jingbing Han, Seungtae Nam, Zhizhong Su, Eunbyung Park

机构 * Sungkyunkwan University(成均馆大学) Horizon Robotics(地平线机器人) Yonsei University(延世大学)

专题命中 三维重建 :3D reconstruction(title,abstract);3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对无姿态前馈3D重建中长序列因姿态漂移致性能下降等问题,提出用光线图引导耦合模块明确耦合几何与外观的协同框架及双频视点调度策略,提升了渲染和姿态估计性能,验证了几何-外观协同的关键作用。

Comments Project page: see https://xiangyu1sun.github.io/NoDrift3R-project-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22482 2026-06-09 cs.CV cs.GR 版本更新 84%

Holo360D: A Large-Scale Real-World Dataset with Continuous Trajectories for Advancing Panoramic 3D Reconstruction and Beyond

Holo360D: 一个大规模真实世界数据集,具有连续轨迹,用于推进全景3D重建及更广泛领域

Jing Ou, Zidong Cao, Yinrui Ren, Zhuoxiao Li, Jinjing Zhu, Tongyan Hua, Shuai Zhang, Hui Xiong, Wufan Zhao

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) South China Normal University(华南师范大学)

专题命中 三维重建 :3D reconstruction(title,abstract);point cloud(abstract);分类 cs.CV、cs.GR

AI总结 本文提出Holo360D数据集,包含109495张全景图像及注册点云、网格和对齐相机姿态,通过连续轨迹和高完整性深度图提升全景3D重建性能,建立新基准并提供有效微调策略。

Comments Datasets Link: https://github.com/Jou719/Holo360D

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30047 2026-07-07 cs.CV 版本更新 83%

Argus: Metric Panoramic 3D Reconstruction for Indoor Scenes

Argus:室内场景的度量全景三维重建

Xi Li, Linyuan Li, Yan Wu, Tong Rao, Kai Zhang, Xinchen Hui, Cihui Pan

机构 * Realsee, China(Realsee中国)

专题命中 三维重建 :3D reconstruction(title,abstract);point cloud(abstract);分类 cs.CV

AI总结 提出混合数据集Realsee3D和端到端网络Argus,通过可学习的共视模块解决全景稀疏捕获中的位姿漂移,并分解像素到世界映射以增强几何一致性,在相机位姿、深度和点云重建上达到最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26567 2026-07-01 cs.CV 版本更新 83%

AirZoo: A Unified Large-Scale Dataset for Grounding Aerial Geometric 3D Vision

AirZoo: 一种用于地面几何3D视觉的统一大规模数据集

Xiaoya Cheng, Rouwan Wu, Xinyi Liu, Zeyu Cui, Yan Liu, Na Zhao, Yu Liu, Maojun Zhang, Shen Yan

机构 * National University of Defense Technology(国防科技大学) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 三维重建 :3D vision(title,abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出AirZoo数据集,通过可扩展生成流程、全面场景多样性和丰富的几何标注,解决无人机感知中复杂视角变换和环境条件的挑战,验证其在三维重建和图像检索中的有效性。

Comments ECCV 2026. Project page: https://nudt-sawlab.github.io/AirZoo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05851 2026-07-01 cs.CV 版本更新 83%

VS3R: Robust Full-frame Video Stabilization via Deep 3D Reconstruction

VS3R:基于深度三维重建的鲁棒全帧视频稳定

Muhua Zhu, Xinhao Jin, Xinping Wang, Yu Zhang, Yifei Xue, Tie Ji, Yizhen Lao

机构 * Hunan University(湖南大学)

专题命中 三维重建 :3D reconstruction(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 提出VS3R框架,结合前馈三维重建与生成式视频扩散,通过联合估计相机参数、深度和掩码,并引入混合稳定渲染模块和稳定驱动扩散模型,实现高保真全帧视频稳定,在鲁棒性和视觉质量上显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20290 2026-07-31 cs.GR cs.CV 版本更新 82%

PhysOmni: Physics-Grounded Multi-Object Scene Generation from a Single Image with Real-Time Interaction

TelePhysics: 从单张图像生成物理一致的多物体场景 with 实时交互

Xin Zhang, Yabo Chen, Yijie Fang, Wanying Qu, Haibin Huang, Chi Zhang, Feng Xu, Xuelong Li

机构 * Fudan University(复旦大学) Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院(TeleAI))

专题命中 三维重建 :3D reconstruction(abstract,abstract_cn);3D generation(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 本文提出TelePhysics,一种无需训练的框架,通过整体场景级3D重建将单张图像转换为物理一致且可控的视频。该方法通过统一的空间坐标系统表示完整场景几何,解决物体穿透和对齐模糊问题,实现准确的多物体交互和更丰富的复杂控制类型,从而在保持逼真视觉保真度的同时实现实时物理交互预览。

Comments ACMMM 2026. Project page: https://physomni.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01869 2026-06-12 cs.CV 版本更新 81%

Visual enhancement and 3D representation for underwater scenes: a review

水下场景的视觉增强与三维表示:综述

Guoxi Huang, Haoran Wang, Brett Seymour, Evan Kovacs, John Ellerbroc, Dave Blackham, Nantheera Anantrasirichai

机构 * Visual Information Laboratory, University of Bristol(视觉信息实验室,布里斯托尔大学) Submerged Resources Center, National Park Service(水下资源中心,国家公园服务) Marine Imaging Technologies, LLC(海洋成像技术有限公司) Gates Underwater Products, Inc(盖茨水下产品公司) Esprit film and television Ltd(Esprit电影和电视有限公司)

专题命中 三维重建 :NeRF(summary_cn);Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 本文综述了水下视觉增强和三维重建方法,从物理模型到非学习与数据驱动技术(如NeRF和3D高斯溅射),并评估了多种算法在基准数据集上的性能,指出了未来研究方向。

Journal ref Artificial Intelligence Review (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03612 2026-08-14 cs.CV cs.LG 版本更新 79%

SAF3R: Dynamic Sparse Attention for Feed-Forward 3D Reconstruction Transformers

SAF3R:用于前馈3D重建Transformer的动态稀疏注意力

Jianing Deng, Yuanzhe Li, Jialu Wang, Song Wang, Tianlong Chen, Huanrui Yang, Jingtong Hu

机构 * University of Pittsburgh(匹兹堡大学) University of Arizona(亚利桑那大学) Tongji University(同济大学) University of Central Florida(中佛罗里达大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 研究前馈3D重建Transformer,分析其全局注意力模式,提出SAF3R框架,集成稀疏注意力机制、离线头部分析和在线适应策略,在保持质量同时提高稀疏率加速端到端速度。

Comments ECCV 2026. Updated related work

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18774 2026-08-06 cs.CV 版本更新 79%

SEAR: Simple and Efficient Adaptation of Visual Geometric Transformers for Unpaired RGB+Thermal 3D Reconstruction

SEAR: 一种简单且高效的视觉几何变换器在RGB+热成像3D重建中的适应

Vsevolod Skorokhodov, Chenghao Xu, Shuo Sun, Olga Fink, Malcolm Mielle

机构 * Schindler EPFL Lab(施耐德EPFL实验室) EPFL(瑞士联邦理工学院) Örebro University(奥雷布罗大学)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 SEAR通过简单高效的微调策略,使预训练的几何变换器适应多模态RGB-热成像输入,显著提升了3D重建和姿态估计性能,尤其在低光照和浓烟等挑战条件下表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05356 2026-07-20 cs.CV 版本更新 79%

ReCal3R: Reliability-Calibrated Learning Rates for Streaming 3D Reconstruction

ReCal3R:面向流式3D重建的可靠性校准学习率

Xinze Li, Yiyuan Wang, Pengxu Chen, Weifeng Su, Weisi Lin, Wentao Cheng

机构 * Beijing Normal-Hong Kong Baptist University(北京师范大学-香港浸会大学联合国际学院) Hong Kong Baptist University(香港浸会大学) Jilin University(吉林大学) Guangdong Provincial Key Laboratory of Interdisciplinary Research and Application for Data Science(广东省数据科学交叉研究与应用重点实验室) Nanyang Technological University(南洋理工大学)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 针对流式3D重建中循环场景状态易被噪声观测破坏的问题,提出可靠性校准学习率方法ReCal3R,在不增加额外开销的前提下大幅提升长序列重建精度。

Comments 23 pages, 7 figures. Project Page: https://powertony102.github.io/recal3r.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13010 2026-07-16 cs.CV 版本更新 79%

DermDepth: Toward Monocular Metric Scale 3D Reconstruction Models for Dermatology

DermDepth:迈向用于皮肤病学的单目度量尺度3D重建模型

Héctor Carrión, Narges Norouzi

机构 * University of California, Santa Cruz(加利福尼亚大学圣克鲁兹分校) University of California, Berkeley(加利福尼亚大学伯克利分校)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 研究针对皮肤病学实践中常用2D方法的现状,提出DermDepth单视图度量尺度3D模型及D-Synth数据集,经实验训练和微调,能有效校正度量尺度误差,在多基准通用并与医学文献测量结果一致。

Comments Accepted at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22615 2026-06-25 cs.CV 版本更新 79%

TTSA3R: Training-Free Temporal-Spatial Adaptive Persistent State for Streaming 3D Reconstruction

TTSA3R:面向流式3D重建的无训练时-空自适应持久状态

Zhijie Zheng, Xinhao Xiang, Jiawei Zhang

机构 * University of California, Davis(加州大学戴维斯分校)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 提出无训练框架TTSA3R,通过时间状态演化与空间观测质量实现自适应状态更新,解决流式3D重建中的灾难性遗忘问题,在长序列上显著提升稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14200 2026-06-24 cs.CV 版本更新 77%

Beyond a Single Light: A Large-Scale Aerial Dataset for Urban Scene Reconstruction Under Varying Illumination

超越单一光源:用于不同光照下城市场景重建的大规模航拍数据集

Zhuoxiao Li, Wenzong Ma, Taoyu Wu, Jinjing Zhu, Shuai Zhang, Jing OU, Tongyan Hua, Yinrui Ren, Rongjun Qin, Hui Xiong, Wufan Zhao

机构 * HKUST(GZ)(香港科技大学(广州)) University of Liverpool(利物浦大学) The Ohio State University(俄亥俄州立大学)

专题命中 三维重建 :Gaussian Splatting(abstract);3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 针对多时相航拍数据光照不一致导致的重建伪影问题,提出SkyLume大规模真实航拍数据集,包含10个城区超10万张高分辨率图像(四个倾斜视角和天底视角),每个区域在三个时段采集以隔离光照变化,并提供LiDAR扫描和3D真值,以及用于评估逆渲染鲁棒性的时间一致性系数(TCC)。

Comments ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.24121 2026-06-17 cs.CV 版本更新 77%

TextMesh4D: Zero-shot Text-to-4D Mesh Generation

TextMesh4D: 零样本文本到4D网格生成

Sisi Dai, Xinxin Su, Kai Xu

机构 * National University of Defense Technology(国防科技大学) Institute of AI for Industries, Chinese Academy of Sciences, Nanjing, 211135, China(中国科学院工业人工智能研究所,南京,211135,中国) Jiangsu Key Laboratory of AI for Industries Institute of AI for Industries, Chinese Academy of Sciences(江苏省人工智能工业关键实验室 中国科学院工业人工智能研究所)

专题命中 三维重建 :3DGS(abstract,abstract_cn);NeRF(abstract_cn);分类 cs.CV

AI总结 提出TextMesh4D框架,通过雅可比变形场和局部-全局语义正则化,实现零样本文本到动态网格生成,解决扩散引导与网格拓扑约束的冲突,达到高时间一致性和几何保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08029 2026-06-16 gr-qc astro-ph.IM cs.CV 版本更新 77%

Dynamic Black-hole Emission Tomography with Physics-informed Neural Fields

基于物理信息神经场的动态黑洞发射断层成像

Berthy T. Feng, Andrew A. Chael, David Bromley, Aviad Levis, William T. Freeman, Katherine L. Bouman

机构 * Caltech(加州理工学院) MIT(麻省理工学院) NSF IAIFI(国家科学基金会IAIFI) Princeton University(普林斯顿大学) Niels Bohr International Academy(尼尔斯·玻尔国际学院) University of Toronto(多伦多大学)

专题命中 三维重建 :NeRF(abstract,abstract_cn);3D reconstruction(abstract);分类 cs.CV

AI总结 提出PI-DEF方法,利用可微神经渲染从EHT测量数据中联合重建4D发射率场和3D速度场,以软约束方式引入物理信息,在模拟数据上显著优于现有方法。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29098 2026-08-06 cs.CV 版本更新 74%

Seeing through boxes: Non-Line-of-Sight 3D Reconstruction from Radar Signals

透视箱子:基于雷达信号的非视距三维重建

Jiachen Lu, Hailan Shanbhag, Haitham Al Hassanieh

机构 * École Polytechnique Fédérale de Lausanne(联邦理工学院洛桑校区)

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 提出统一视距与非视距神经几何重建框架GeRaF 2.0,利用外部视距几何约束引导射频信号传播,实现稳定训练和物理一致的重建,在射频几何重建中达到新最优。

Comments Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28622 2026-07-14 cs.CV cs.GR 版本更新 73%

Meshtryoshka: Differentiable Rendering of Real-World Scenes via Mesh Rasterization

Meshtryoshka: 通过网格光栅化实现真实场景的可微分渲染

David Charatan, Daniel Xu, Richard Szeliski, George Kopanas, Vincent Sitzmann

机构 * Massachusetts Institute of Technology(麻省理工学院) University of Washington(华盛顿大学) Google DeepMind(谷歌DeepMind)

专题命中 三维重建 :3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV、cs.GR

AI总结 提出Meshtryoshka框架,利用嵌套网格壳表示和现成三角形光栅化器,通过符号距离函数间接更新顶点位置,实现大规模无界场景的高质量可微分渲染。

Comments Daniel Xu and David Charatan contributed equally; author order decided by coin flip. Project website: https://danielxu9393.github.io/meshtryoshka-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01204 2026-07-10 cs.CV cs.AI cs.GR cs.LG 版本更新 73%

Neural Harmonic Textures for High-Quality Primitive Based Neural Reconstruction

基于神经谐波纹理的高质量基于原始体的神经重建

Jorge Condor, Nicolas Moenne-Loccoz, Merlin Nimier-David, Piotr Didyk, Zan Gojcic, Qi Wu

机构 * NVIDIA(英伟达) Università della Svizzera italiana(瑞士意大利语区大学)

专题命中 三维重建 :Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV、cs.GR

AI总结 本文提出神经谐波纹理,通过虚拟框架锚定潜在特征向量,实现高效实时视图合成,融合原始体与神经场方法,提升高频细节建模能力。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10726 2026-08-04 cs.CV 版本更新 70%

WorldMirror: Universal 3D World Reconstruction with Any-Prior Prompting

WorldMirror:基于任意先验提示的通用三维世界重建

Yifan Liu, Zhiyuan Min, Zhenwei Wang, Junta Wu, Tengfei Wang, Yixuan Yuan, Yawei Luo, Chunchao Guo

机构 * Zhejiang University(浙江大学) Chinese University of Hong Kong(香港中文大学) Tencent Hunyuan(腾讯混元)

专题命中 三维重建 :point cloud(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本研究提出WorldMirror这一统一前馈模型,可整合多种几何先验并生成多种三维表示,在多类三维几何任务的基准测试中达到最优性能且推理效率高。

Comments Accepted to ICML 2026. Code: https://github.com/Tencent-Hunyuan/HunyuanWorld-Mirror Project page: https://3d-models.hunyuan.tencent.com/world/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06945 2026-08-04 cs.CV 版本更新 70%

Direct and Adaptable Mesh-Gaussian Scene Reconstruction from Multi-View Images

从多视图图像进行直接且可自适应的网格-高斯场景重建

Ancheng Lin, Tianqing Su, Zuo Yuan, Quanke Su, Samuel S. Mao, Yusheng Xiang

机构 * School of Computer Science, Australian Artificial Intelligence Institute (AAII)(计算机科学学院,澳大利亚人工智能研究所) University of Technology Sydney(悉尼技术大学) School of Automobile(汽车学院) Chang’an University(长安大学)

专题命中 三维重建 :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 该研究针对现有方法分离几何与外观建模的问题,提出端到端网格-高斯场景表示,实现直接联合学习,提升重建效率与质量,可高效适配局部场景修改,支撑具身智能相关环境维护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04931 2026-07-07 cs.CV 版本更新 70%

LoMa: Local Feature Matching Revisited

LoMa:局部特征匹配的再审视

David Nordström, Johan Edstedt, Georg Bökman, Jonathan Astermark, Anders Heyden, Viktor Larsson, Mårten Wadenbäck, Michael Felsberg, Fredrik Kahl

机构 * Chalmers University of Technology(查尔姆斯理工大学) Linköping University(林雪平大学) University of Amsterdam(阿姆斯特丹大学) Centre for Mathematical Sciences, Lund University(隆德大学数学科学中心)

专题命中 三维重建 :3D vision(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 本文从数据驱动角度重新审视局部特征匹配,提出LoMa方法,通过结合大规模数据混合、现代训练方案和模型容量,提升了性能,并在新数据集HardMatch上取得显著成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24852 2026-08-04 cs.CV cs.RO 版本更新 62%

Track-Leakage-Free Hold-Out Self-Validation for Photogrammetric Reconstruction: Protocol, Sensitivity, and Limits

用于摄影测量重建的无轨迹泄漏留出法自验证:协议、敏感性和局限性

Behnam Asadi

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 研究摄影测量重建在无地面真值时估计自身可靠性的问题,提出无轨迹泄漏留出协议,通过特定图像子集和3D点重新定位计算mAA置信度,发现该协议能测内部几何一致性,但非绝对精度,不可替代控制点评估和严重失败门限。

Comments 16 pages, 4 figures. v3: code, harness and result tables archived at Zenodo (doi:10.5281/zenodo.21737748); adds related-work discussion of RayZer/E-RayZer; worked example now computed by the released script; results unchanged. Negative/characterisation result: a ground-truth-free self-consistency signal saturates and is blind to coherent global distortion

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05131 2026-08-03 cs.CV cs.AI cs.RO 版本更新 62%

AREA3D: Active Reconstruction Agent with Unified Feed-Forward 3D Perception and Vision-Language Guidance

AREA3D: 带有统一前馈3D感知和视觉-语言引导的主动重建代理

Tianling Xu, Shengzhe Gan, Leslie Gu, Yuelei Li, Fangneng Zhan, Hanspeter Pfister

机构 * Southern University of Science and Technology(南方科技大学) Harvard University(哈佛大学) California Institute of Technology(加州理工学院) Massachusetts Institute of Technology(麻省理工学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 AREA3D通过统一前馈3D感知与视觉-语言引导,实现高效主动3D重建,尤其在稀疏视角下提升重建精度。

Journal ref Tianling Xu, Shengzhe Gan, Leslie Gu, Yuelei Li, Fangneng Zhan, Hanspeter Pfister. The IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (The IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23204 2026-07-21 cs.CV cs.RO 版本更新 62%

Motion-aware Event Suppression for Event Cameras

面向事件相机的运动感知事件抑制

Roberto Pellerito, Nico Messikommer, Giovanni Cioffi, Marco Cannici, Davide Scaramuzza

机构 * Robotics and Perception Group, University of Zurich, Switzerland(苏黎世大学机器人与感知组,瑞士)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 提出首个运动感知事件抑制框架,通过联合分割当前事件流中的独立运动物体并预测其未来运动,实现动态事件的预期抑制,在EVIMO基准上分割精度提升67%,推理速度提高53%。

Comments Robotics: Science and Systems (RSS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09815 2026-07-17 cs.RO cs.CV 版本更新 62%

RASR: Range-Aware Scale Recovery for Metric UAV Navigation

RASR:用于度量无人机导航的距离感知尺度恢复

Hongtao Liang, Xinyu Shao, Chenxu Wang, Yiyao Wan, Jiahuan Ji, Fangwei Ye, Fuhui Zhou, Qihui Wu

机构 * College of Electronic and Information Engineering, Nanjing University of Aeronautics and Astronautics(南京航空航天大学电子信息工程学院) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Noah Ark Lab, Huawei(华为诺亚方舟实验室) College of Automation Engineering, Nanjing University of Aeronautics and Astronautics(南京航空航天大学自动化工程学院) College of Artificial Intelligence, Nanjing University of Aeronautics and Astronautics(南京航空航天大学人工智能学院) College of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(南京航空航天大学计算机科学与技术学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 研究在GNSS信号阻断时无人机精确最后一米导航问题,提出RASR方法,将尺度恢复核心与校准模块分离,核心压缩几何成描述符并全局校准,校准模块进行残差校正和对齐,在PairUAV评估中取得较好结果。

Comments 5 pages, 4 figures. Technical report for the UAVM 2026 PairUAV Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05801 2026-07-15 cs.CV cs.RO 版本更新 62%

TRIG: Trajectory-Rig Decoupled Metric Geometry Learning

TRIG:轨迹-装置解耦度量几何学习

Lizhou Liao, Wentao Xu, Handong Wang, Lirong Yang, Shuai Yang, Weiwei Liu, Chang Huang

机构 * Carizon(卡里松) ShanghaiTech University(上海科技大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 针对自动驾驶中视觉几何模型不适用于刚性多相机驱动系统的问题,提出TRIG框架,将相机姿态分解,引入解耦编码与监督及稀疏时空注意力,在多基准测试中实现姿态估计、深度预测和3D重建的最优性能。

Comments 10 pages, 4 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09100 2026-07-01 cs.CV cs.RO 版本更新 62%

Physically Grounded 3D Generative Reconstruction under Hand Occlusion using Proprioception and Multi-Contact Touch

基于本体感知和多接触触觉的物理 grounded 的 3D 生成重建在手部遮挡下

Gabriele Mario Caddeo, Pasquale Marra, Lorenzo Natale

机构 * Istituto Italiano di Tecnologia(意大利技术研究院)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV、cs.RO

AI总结 本文提出了一种多模态、物理 grounded 的方法,用于在严重手部遮挡下进行度量尺度的无遮挡物体重建和姿态估计,通过本体感知和多接触触觉信号提升重建精度和物理一致性。

Comments 29 pages, 10 figures, Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05517 2026-06-29 cs.CV cs.LG cs.RO 版本更新 62%

Web2Grasp: Learning Functional Grasps from Web Images of Hand-Object Interactions

Web2Grasp:从网络手物交互图像中学习功能性抓取

Hongyi Chen, Yunchao Yao, Yufei Ye, Zhixuan Xu, Homanga Bharadhwaj, Jiashun Wang, Arthur Jakobsson, Ruihan Zhao, Shubham Tulsiani, Zackory Erickson, Jeffrey Ichnowski

机构 * Carnegie Mellon University(卡内基梅隆大学) Nvidia(英伟达) National University of Singapore(新加坡国立大学) UT Austin(德克萨斯大学奥斯汀分校)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 提出从网络图像中提取人手抓取信息,利用3D重建和交互中心模型学习功能性抓取,在仿真和真实实验中优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08262 2026-06-23 cs.RO cs.AI cs.CV 版本更新 62%

CLAR: Learning 3D Representations for Robotic Manipulation by Fusing Masked Reconstruction with Multi-Level Contrastive Alignment

CLAR: 通过融合掩码重建与多层级对比对齐学习用于机器人操作的3D表示

Wenbo Cui, Chengyang Zhao, Yuhui Chen, Haoran Li, Zhizheng Zhang, Dongbin Zhao, He Wang

机构 * SKL-MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所SKL-MAIS) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Carnegie Mellon University(卡内基梅隆大学) Galbot CFCS, School of Computer Science, Peking University(北京大学计算机科学与技术学院CFCS)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出CLAR框架,融合掩码自编码与全局跨模态对比学习,并引入基于可变形注意力的局部自适应对齐机制,解决3D预训练中空间几何与语义细节的权衡问题,在视觉运动策略学习中达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22685 2026-06-08 eess.IV cs.CV cs.GR 版本更新 62%

VIRTUS-FPP: Virtual Sensor Modeling for Fringe Projection Profilometry in NVIDIA Isaac Sim

VIRTUS-FPP:NVIDIA Isaac Sim中条纹投影轮廓测量的虚拟传感器建模

Adam Haroon, Anush Lakshman, Badrinath Balasubramaniam, Beiwen Li

机构 * Department of Mechanical Engineering, Iowa State University(Iowa州立大学机械工程系) College of Engineering, University of Georgia(佐治亚大学工程学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 提出VIRTUS-FPP,首个在NVIDIA Isaac Sim中实现的端到端虚拟传感器建模框架,用于条纹投影轮廓测量,实现物理保真模拟,无需预校准物理系统,支持亚毫米级重建精度。

Comments 10 pages, 13 figures, accepted for publication in IEEE Sensors Journal

详情

展开后加载摘要…

URL PDF HTML 收藏