arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-02 至 2026-07-02 共收录 11 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 11 篇

2607.00375 2026-07-02 cs.CV 新提交 79%

LIST3R: Long-sequence Instance-aware 3D Reconstruction

LIST3R: 长序列实例感知三维重建

Jing Gao, Wei Wang, Feiran Wang, Yan Yan

机构 * Beijing Jiaotong University(北京交通大学) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 提出LIST3R框架,通过实例锚点组织长序列三维重建,将子序列局部观测整合为全局一致场景,在长序列基准上实现更优轨迹与重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00829 2026-07-02 cs.CV 新提交 57%

Stitched Embeddings: A Unified Latent Space for 3D Garments and 2D Patterns

缝合嵌入:3D服装与2D纸样的统一潜在空间

Andrea Sanchietti, Riccardo Marin, Bharat Lal Bhatnagar, Yuanlu Xu, Gerard Pons-Moll

机构 * University of Tübingen(图宾根大学) Tübingen AI Center(图宾根人工智能中心) Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Max Planck Institute for Informatics(马克斯·普朗克信息学研究所) Meta

专题命中 三维重建 :3D vision(abstract);分类 cs.CV

AI总结 提出首个无需模拟的框架Stitched Embeddings,通过BoxMesh中间表示在统一双向潜在空间中实现3D服装重建与2D纸样推断,达到高精度高效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00498 2026-07-02 cs.CV 新提交 57%

Robust 3D Alignment of Generative Reconstructions via Partial Monocular Observations

基于部分单目观测的生成式重建鲁棒3D对齐

Yuchen Zhang, Luanyuan Dai, Yiwei Wang, Xiwei Xu, Jianing Zhang, Johnny. r. zhang, Xianhui Meng, Yanbiao Ma, Jiayi Ma, Xiaoshuai Hao

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与技术学院) School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) School of Engineering and Applied Science, University of Pennsylvania(宾夕法尼亚大学工程与应用科学学院) School of Tech Electrical and Information Engineering, Tianjin University(天津大学电气与信息工程学院) Independent Researcher(独立研究员) School of Electronic Engineering and Information Science, University of Science and Technology of China(中国科学技术大学电子工程与信息科学学院) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) School of Robotics, Wuhan University(武汉大学机器人学院) Xiaomi EV(小米汽车)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对生成式3D重建与部分单目观测对齐的挑战,提出无训练可解释几何对齐框架,通过Sim(3)变换恢复度量尺度与位姿,引入幻觉滤波抑制异常,在基准测试中显著优于传统和学习方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00417 2026-07-02 cs.CV cs.AI 新提交 57%

EO-VGGT: Orbital Ray-Conditioned 3D Foundation Models for Satellite Multi-View Reconstruction

EO-VGGT:用于卫星多视角重建的轨道光线条件化3D基础模型

Qiyan Luo, Yingdong Pi, Lekang Wen, Jie Yang, Xiaoyu Wang, Haiming Zhang, Mi Wang

机构 * State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing, Wuhan University(武汉大学测绘遥感信息工程国家重点实验室) Hubei Luojia Laboratory(湖北珞珈实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对卫星遥感中透视模型与轨道几何不匹配的问题,提出EO-VGGT框架,通过几何相关约束选择、传感器射线编码器和射线指向适配器,实现冻结视角驱动模型适应轨道观测,提升多视角卫星3D重建质量。

Comments This article is submitted to journal and under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00382 2026-07-02 cs.CV 新提交 57%

Vitality-Aware Compression for Efficient Image-to-Shape Diffusion Transformers

活力感知压缩:面向高效图像到形状扩散Transformer

Jaeah Lee, Hyunjin Kim, Jaewoong Cho, Gihyun Kwon

机构 * KRAFTON AI, Republic of Korea(KRAFTON AI, 韩国) Amazon, Australia(亚马逊, 澳大利亚)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 提出首个针对图像到形状扩散Transformer的压缩方法,通过活力引导的结构化剪枝、自适应量化和微调,在保持几何保真度下实现高达66%的模型尺寸缩减。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00157 2026-07-02 cs.CV 新提交 57%

Progressive Pose-Guided 4D Animal Reconstruction from Monocular Video

渐进式姿态引导的单目视频4D动物重建

Siyuan Li, Weiying Chen, Yilin Wang, Xinxin Zuo, Xingyu Li, Li Cheng

机构 * University of Alberta(阿尔伯塔大学) Concordia University(康科迪亚大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出一种基于3D高斯溅射的渐进式测试时优化框架,通过解耦关节姿态与非刚性变形,实现从单目视频高保真重建4D动物,在多种物种上优于现有方法。

Comments Accepted to ECCV 2026. Camera-ready author version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23365 2026-07-02 cs.CV 版本更新 57%

SpatialMosaic: A Multiview VLM Dataset for Partial Visibility

SpatialMosaic:一个多视角VLM数据集用于部分可见性

Kanghee Lee, Jungi Hong, Sion Lee, Injae Lee, Minseok Kwak, Kwonyoung Ryu, Jaesik Park

机构 * Seoul National University(首尔大学) University College London(伦敦大学学院) Kyung Hee University(庆熙大学) POSTECH(浦项科技大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出SpatialMosaic数据集,通过多视角图像生成2M问答对,引入SpatialMosaic-Bench基准测试,结合3D重建模型的混合框架提升空间推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13859 2026-07-02 cs.CV 版本更新 57%

Geo-ID: Test-Time Geometric Consensus for Cross-View Consistent Intrinsics

Geo-ID: 测试时几何一致性用于跨视角一致本征分解

Alara Dirik, Stefanos Zafeiriou

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出Geo-ID框架,利用稀疏几何对应关系在测试时耦合单视角本征预测,实现跨视角一致分解,无需重训练或逆渲染。

Comments Accepted to ECCV 2026. Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08279 2026-07-02 cs.CV 版本更新 57%

OSCAR: Occupancy-based Shape Completion via Acoustic Neural Implicit Representations

OSCAR: 基于占用率的声学神经隐式表示形状补全

Magdalena Wysocki, Kadir Burak Buldu, Miruna-Alexandra Gafencu, Mohammad Farid Azampour, Nassir Navab

机构 * Chair for Computer Aided Medical Procedures (CAMP) Technical University of Munich(慕尼黑工业大学计算机辅助医疗程序教席(CAMP)) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML)) Konrad Zuse School of Excellence in Reliable AI (relAI)(康拉德·楚泽可靠人工智能卓越学校(relAI))

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出基于占用率的形状补全方法,利用声学神经隐式表示从部分超声观测中重建完整3D解剖结构,无需标签,在HD95指标上优于现有方法80%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00412 2026-07-02 cs.GR 57%

ViscoReg: Neural Signed Distance Functions via Viscosity Solutions

ViscoReg:通过粘性解的神经符号距离函数

Meenakshi Krishnan, Ramani Duraiswami

专题命中 三维重建 :point cloud(abstract);分类 cs.GR

AI总结 本文提出ViscoReg,通过粘性解理论稳定神经符号距离函数训练,优于SIREN、DiGS和StEik等方法,在ShapeNet和3D场景重建数据集上表现优异。

Comments 21 pages, 7 figures

Journal ref Transactions on Machine Learning Research, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01123 2026-07-02 physics.ins-det eess.SP physics.optics 新提交 50%

Plenoptic imaging of particle interactions in scintillation detectors

闪烁体探测器中粒子相互作用的全光成像

Xiang Dai, Chi-Jui Ho, Kevin Tandi, Chang Lee, Alex Bocchieri, David Parra, Forrest Peterson, Talha Sultan, Felicia Sutanto, Andreas Velten, Jingke Xu, Nicholas Antipa

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 提出PRISM多焦点全光成像系统,通过多焦距微透镜阵列平衡光子收集与深度编码,在光子匮乏条件下实现毫米级3D定位,平均误差约1mm。

详情

展开后加载摘要…

URL PDF HTML 收藏