arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 4394 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4394 篇

2505.20426 2025-11-26 cs.CV 57%

MMPerspective: Do MLLMs Understand Perspective? A Comprehensive Benchmark for Perspective Perception, Reasoning, and Robustness

MMPerspective: 多模态大语言模型是否理解视角?一个全面的视角感知、推理和鲁棒性评估基准

Yolo Y. Tang, Pinxin Liu, Zhangyun Tan, Mingqian Feng, Rui Mao, Chao Huang, Jing Bi, Yunzhong Xiao, Susan Liang, Hang Hua, Ali Vosoughi, Luchuan Song, Zeliang Zhang, Chenliang Xu

机构 * University of Rochester(罗切斯特大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 三维重建 :spatial understanding(abstract);分类 cs.CV

AI总结 MMPerspective通过10个任务评估多模态大语言模型在视角感知、推理和鲁棒性方面的能力,揭示其在空间一致性维持和组合推理上的局限性。

Comments Accepted to NeurIPS 2025 DB Track. Rating: 5,5,5,5

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06385 2025-11-26 cs.CV 57%

SD-MVS: Segmentation-Driven Deformation Multi-View Stereo with Spherical Refinement and EM optimization

基于分割驱动的变形多视图立体重建:球面细化与EM优化

Zhenlong Yuan, Jiakai Cao, Zhaoxin Li, Hao Jiang, Zhaoqi Wang

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 SD-MVS通过结合SAM分割与EM优化,提升无纹理区域的3D重建完整性与效率。

Comments Published to AAAI2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19189 2025-11-25 cs.GR 57%

AvatarBrush: Monocular Reconstruction of Gaussian Avatars with Intuitive Local Editing

AvatarBrush: 基于单目视频的高斯姿态重建与直观局部编辑

Mengtian Li, Shengxiang Yao, Yichen Pan, Haiyao Xiao, Zhongmei Li, Zhifeng Xie, Keyu Chen

专题命中 三维重建 :3DGS(abstract);分类 cs.GR

AI总结 AvatarBrush通过单目视频输入实现高斯姿态的高效重建与直观局部编辑,提升编辑灵活性和用户体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18563 2025-11-25 cs.RO 57%

Object-centric Task Representation and Transfer using Diffused Orientation Fields

基于扩散方向场的对象中心任务表示与迁移

Cem Bilaloglu, Tobias Löw, Sylvain Calinon

机构 * Idiap Research Institute(Idiap研究机构) EPFL(瑞士联邦理工学院)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 本文提出利用扩散方向场实现跨弯曲物体的任务迁移,通过平滑局部参考系建立稀疏关键点对应关系,成功迁移连续物理交互任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18290 2025-11-25 cs.CV cs.AI 57%

SwiftVGGT: A Scalable Visual Geometry Grounded Transformer for Large-Scale Scenes

SwiftVGGT: 一种可扩展的视觉几何基础Transformer用于大规模场景

Jungho Lee, Minhyeok Lee, Sunghun Yang, Minseok Kang, Sangyoun Lee

机构 * School of Electrical and Electronic Engineering, Yonsei University(电气电子工程学院,延世大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 SwiftVGGT是一种无需训练的高效Transformer,通过简化计算流程实现大规模场景中高质量3D重建。

Comments Project Page: https://Jho-Yonsei.github.io/SwiftVGGT/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18215 2025-11-25 cs.RO 57%

AFT: Appearance-Based Feature Tracking for Markerless and Training-Free Shape Reconstruction of Soft Robots

AFT:基于外观的特征追踪用于无标记和无训练的软机器人形状重建

Shangyuan Yuan, Preston Fairchild, Yu Mei, Xinyu Zhou, Xiaobo Tan

机构 * Department of Electrical and Computer Engineering, Michigan State University(电气与计算机工程系,密歇根州立大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 本文提出了一种基于外观的无标记、无训练软机器人形状重建方法,通过隐式视觉标记实现实时追踪,具有高鲁棒性和低成本优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04258 2025-11-25 cs.CV 57%

MoReMouse: Monocular Reconstruction of Laboratory Mouse

MoReMouse: 单目重建实验室小鼠

Yuan Zhong, Jingxiang Sun, Zhongbin Zhang, Liang An, Yebin Liu

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 MoReMouse通过创新的合成数据集、变换器架构与三平面表示,实现了高保真小鼠3D重建,提升重建精度与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02387 2025-11-25 cs.RO cs.SY eess.SY 57%

RGBSQGrasp: Inferring Local Superquadric Primitives from Single RGB Image for Graspability-Aware Bin Picking

RGBSQGrasp: 从单张RGB图像推断局部超二次曲面原语以实现抓取感知的托盘拾取

Yifeng Xu, Fan Zhu, Ye Li, Sebastian Ren, Xiaonan Huang, Yuhao Chen

机构 * University of Michigan(密歇根大学) University of Waterloo(滑铁卢大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) University College London(伦敦大学学院)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 RGBSQGrasp通过单目RGB图像推断抓取姿态,利用超二次曲面原语提升托盘拾取任务的抓取稳定性和适应性。

Comments 8 pages, 6 figures, IROS2025 RGMCW Best Workshop Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17497 2025-11-24 cs.RO 57%

HALO: High-Altitude Language-Conditioned Monocular Aerial Exploration and Navigation

HALO:高海拔语言条件化单目空中探索与导航

Yuezhan Tao, Dexter Ong, Fernando Cladera, Jason Hughes, Camillo J. Taylor, Pratik Chaudhari, Vijay Kumar

机构 * GRASP Laboratory, University of Pennsylvania(宾夕法尼亚大学GRASP实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 HALO通过单目相机与GPS/IMU实现高海拔环境的实时度量-语义映射与导航,支持多任务自主探索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17484 2025-11-24 cs.CV 57%

Radar2Shape: 3D Shape Reconstruction from High-Frequency Radar using Multiresolution Signed Distance Functions

Radar2Shape:基于高频雷达的多分辨率符号距离函数的3D形状重建

Neel Sortur, Justin Goodwin, Purvik Patel, Luis Enrique Martinez, Tzofi Klinghoffer, Rajmonda S. Caceres, Robin Walters

机构 * Northeastern University(东北大学) MIT Lincoln Laboratory(麻省理工学院林肯实验室) Massachusetts Institute of Technology(麻省理工学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 Radar2Shape通过多分辨率符号距离函数和去噪扩散模型,实现从部分观测高频雷达信号中重建任意3D形状。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16807 2025-11-24 cs.CV cs.AI 57%

Mesh RAG: Retrieval Augmentation for Autoregressive Mesh Generation

Mesh RAG: 用于自回归网格生成的检索增强

Xiatao Sun, Chen Liang, Qian Wang, Daniel Rakita

机构 * Yale University(耶鲁大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 Mesh RAG通过检索增强方法提升自回归网格生成的效率和质量,实现快速生成与增量编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16317 2025-11-21 cs.CV 57%

NaTex: Seamless Texture Generation as Latent Color Diffusion

NaTex: 无缝纹理生成作为潜在颜色扩散

Zeqiang Lai, Yunfei Zhao, Zibo Zhao, Xin Yang, Xin Huang, Jingwei Huang, Xiangyu Yue, Chunchao Guo

机构 * MMLab, CUHK(CUHK多媒体实验室) Tencent Hunyuan(腾讯文生)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 NaTex通过直接在3D空间中预测纹理颜色,提出潜在颜色扩散方法,实现高效且一致的纹理生成与重建。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14948 2025-11-20 cs.CV 57%

RocSync: Millisecond-Accurate Temporal Synchronization for Heterogeneous Camera Systems

Jaro Meyer, Frédéric Giraud, Joschua Wüthrich, Marc Pollefeys, Philipp Fürnstahl, Lilian Calvet

机构 * ETH Zurich(苏黎世联邦理工学院) Balgrist University Hospital(巴尔格里斯大学医院) University of Zurich(苏黎世大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12204 2025-11-20 cs.CV 57%

GeoMVD: Geometry-Enhanced Multi-View Generation Model Based on Geometric Information Extraction

Jiaqi Wu, Yaosen Chen, Shuyuan Zhu

机构 * University of Electronic Science and Technology of China(电子科技大学) Sobey Media Intelligence Laboratory(索贝媒体智能实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14601 2025-11-19 cs.CV cs.AI 57%

MRI Embeddings Complement Clinical Predictors for Cognitive Decline Modeling in Alzheimer's Disease Cohorts

Nathaniel Putera, Daniel Vilet Rodríguez, Noah Videcrantz, Julia Machnio, Mostafa Mehdipour Ghazi

专题命中 三维重建 :3D vision(abstract);分类 cs.CV

Comments Accepted at SPIE - Medical Imaging Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13015 2025-11-19 cs.CV 57%

Geometry Meets Light: Leveraging Geometric Priors for Universal Photometric Stereo under Limited Multi-Illumination Cues

King-Man Tam, Satoshi Ikehata, Yuta Asano, Zhaoyi An, Rei Kawakami

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

Comments Accepted by AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12977 2025-11-19 cs.CV 57%

ArtiWorld: LLM-Driven Articulation of 3D Objects in Scenes

Yixuan Yang, Luyang Xie, Zhen Luo, Zixiang Zhao, Tongsheng Ding, Mingqi Gao, Feng Zheng

机构 * SUSTech(四川大学) SII ETH Zürich(苏黎世联邦理工学院) Spatialtemporal AI(时空人工智能)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13713 2025-11-18 cs.CV 57%

Free-Form Scene Editor: Enabling Multi-Round Object Manipulation like in a 3D Engine

Xincheng Shuai, Zhenyuan Qin, Henghui Ding, Dacheng Tao

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

Comments AAAI 2026, Project Page: https://henghuiding.com/FFSE/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12909 2025-11-18 cs.CV 57%

CASL: Curvature-Augmented Self-supervised Learning for 3D Anomaly Detection

Yaohua Zha, Xue Yuerong, Chunlin Fan, Yuansong Wang, Tao Dai, Ke Chen, Shu-Tao Xia

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14659 2025-11-18 cs.CV 57%

GUSLO: General and Unified Structured Light Optimization

Tinglei Wan, Tonghua Su, Zhongjie Wang

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11563 2025-11-17 cs.CV 57%

LARM: A Large Articulated-Object Reconstruction Model

Sylvia Yuan, Ruoxi Shi, Xinyue Wei, Xiaoshuai Zhang, Hao Su, Minghua Liu

机构 * University of California San Diego(加州大学圣地亚哥分校) Hillbot Inc.(Hillbot公司)

专题命中 三维重建 :novel view synthesis(abstract);分类 cs.CV

Comments project page: https://sylviayuan-sy.github.io/larm-site/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10142 2025-11-14 cs.CV 57%

Split-Layer: Enhancing Implicit Neural Representation by Maximizing the Dimensionality of Feature Space

Zhicheng Cai, Hao Zhu, Linsen Chen, Qiu Shen, Xun Cao

专题命中 三维重建 :novel view synthesis(abstract);分类 cs.CV

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06734 2025-11-11 cs.CV 57%

Rethinking Rainy 3D Scene Reconstruction via Perspective Transforming and Brightness Tuning

Qianfeng Yang, Xiang Chen, Pengpeng Li, Qiyuan Guan, Guiyue Jin, Jiyu Jin

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

Comments Accepted by AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26618 2025-11-11 cs.CV 57%

DA$^{2}$: Depth Anything in Any Direction

Haodong Li, Wangguangdong Zheng, Jing He, Yuhao Liu, Xin Lin, Xin Yang, Ying-Cong Chen, Chunchao Guo

专题命中 三维重建 :3D vision(abstract);分类 cs.CV

Comments Work primarily done during an internship at Tencent Hunyuan. Project page: https://depth-any-in-any-dir.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02560 2025-11-11 cs.CV 57%

FastVGGT: Training-Free Acceleration of Visual Geometry Transformer

You Shen, Zhipeng Zhang, Yansong Qu, Xiawu Zheng, Jiayi Ji, Shengchuan Zhang, Liujuan Cao

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学) AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院自动化实验室)

专题命中 三维重建 :3D vision(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18474 2025-11-11 cs.RO 57%

Canonical Policy: Learning Canonical 3D Representation for SE(3)-Equivariant Policy

Zhiyuan Zhang, Zhengtong Xu, Jai Nanda Lakamsani, Yu She

机构 * Purdue University(普渡大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19604 2025-11-11 eess.IV cs.CV 57%

X-Diffusion: Generating Detailed 3D MRI Volumes From a Single Image Using Cross-Sectional Diffusion Models

Emmanuelle Bourigault, Abdullah Hamdi, Amir Jamaludin

机构 * Visual Geometry Group, University of Oxford(牛津大学视觉几何组)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

Comments accepted at ICCV 2025 GAIA workshop https://era-ai-biomed.github.io/GAIA/ , project website: https://emmanuelleb985.github.io/XDiffusion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18090 2025-11-10 cs.CV 57%

GeoSVR: Taming Sparse Voxels for Geometrically Accurate Surface Reconstruction

Jiahe Li, Jiawei Zhang, Youmin Zhang, Xiao Bai, Jin Zheng, Xiaohan Yu, Lin Gu

机构 * School of Computer Science and Engineering, State Key Laboratory of Complex Critical Software Environment, Jiangxi Research Institute, Beihang University(北京航空航天大学计算机科学与工程学院、复杂临界软件环境国家重点实验室、江西研究院) Rawmantic AI State Key Laboratory of Virtual Reality Technology and Systems, Beijing(虚拟现实技术与系统国家重点实验室) Macquarie University(麦考瑞大学) RIKEN AIP(日本理化学研究所AIP) The University of Tokyo(东京大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

Comments Accepted at NeurIPS 2025 (Spotlight). Project page: https://fictionarry.github.io/GeoSVR-project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02938 2025-11-07 cs.CV 57%

MIND: Material Interface Generation from UDFs for Non-Manifold Surface Reconstruction

Xuhui Chen, Fei Hou, Wencheng Wang, Hong Qin, Ying He

机构 * Key Laboratory of System Software and State Key Laboratory of Computer Science, Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所系统软件重点实验室、计算机科学国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Department of Computer Science, Stony Brook University(石溪大学计算机科学系) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

Comments NIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04199 2025-11-07 cs.RO 57%

GraspView: Active Perception Scoring and Best-View Optimization for Robotic Grasping in Cluttered Environments

Shenglin Wang, Mingtong Dai, Jingxuan Su, Lingbo Liu, Chunjie Chen, Xinyu Wu, Liang Lin

机构 * Peng Cheng Laboratory(鹏城实验室) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院) Shenzhen Graduate School, Peking University(深圳研究生院) University of Chinese Academy of Sciences(中国科学院大学) School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) X-Era AI Lab(X-Era AI实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏