arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-02 至 2026-07-02 共收录 20 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 7 篇

2607.00375 2026-07-02 cs.CV 新提交 79%

LIST3R: Long-sequence Instance-aware 3D Reconstruction

LIST3R: 长序列实例感知三维重建

Jing Gao, Wei Wang, Feiran Wang, Yan Yan

机构 * Beijing Jiaotong University(北京交通大学) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 提出LIST3R框架,通过实例锚点组织长序列三维重建,将子序列局部观测整合为全局一致场景,在长序列基准上实现更优轨迹与重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00829 2026-07-02 cs.CV 新提交 57%

Stitched Embeddings: A Unified Latent Space for 3D Garments and 2D Patterns

缝合嵌入:3D服装与2D纸样的统一潜在空间

Andrea Sanchietti, Riccardo Marin, Bharat Lal Bhatnagar, Yuanlu Xu, Gerard Pons-Moll

机构 * University of Tübingen(图宾根大学) Tübingen AI Center(图宾根人工智能中心) Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Max Planck Institute for Informatics(马克斯·普朗克信息学研究所) Meta

专题命中 三维重建 :3D vision(abstract);分类 cs.CV

AI总结 提出首个无需模拟的框架Stitched Embeddings,通过BoxMesh中间表示在统一双向潜在空间中实现3D服装重建与2D纸样推断,达到高精度高效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00498 2026-07-02 cs.CV 新提交 57%

Robust 3D Alignment of Generative Reconstructions via Partial Monocular Observations

基于部分单目观测的生成式重建鲁棒3D对齐

Yuchen Zhang, Luanyuan Dai, Yiwei Wang, Xiwei Xu, Jianing Zhang, Johnny. r. zhang, Xianhui Meng, Yanbiao Ma, Jiayi Ma, Xiaoshuai Hao

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与技术学院) School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) School of Engineering and Applied Science, University of Pennsylvania(宾夕法尼亚大学工程与应用科学学院) School of Tech Electrical and Information Engineering, Tianjin University(天津大学电气与信息工程学院) Independent Researcher(独立研究员) School of Electronic Engineering and Information Science, University of Science and Technology of China(中国科学技术大学电子工程与信息科学学院) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) School of Robotics, Wuhan University(武汉大学机器人学院) Xiaomi EV(小米汽车)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对生成式3D重建与部分单目观测对齐的挑战,提出无训练可解释几何对齐框架,通过Sim(3)变换恢复度量尺度与位姿,引入幻觉滤波抑制异常,在基准测试中显著优于传统和学习方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00417 2026-07-02 cs.CV cs.AI 新提交 57%

EO-VGGT: Orbital Ray-Conditioned 3D Foundation Models for Satellite Multi-View Reconstruction

EO-VGGT:用于卫星多视角重建的轨道光线条件化3D基础模型

Qiyan Luo, Yingdong Pi, Lekang Wen, Jie Yang, Xiaoyu Wang, Haiming Zhang, Mi Wang

机构 * State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing, Wuhan University(武汉大学测绘遥感信息工程国家重点实验室) Hubei Luojia Laboratory(湖北珞珈实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对卫星遥感中透视模型与轨道几何不匹配的问题,提出EO-VGGT框架,通过几何相关约束选择、传感器射线编码器和射线指向适配器,实现冻结视角驱动模型适应轨道观测,提升多视角卫星3D重建质量。

Comments This article is submitted to journal and under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00382 2026-07-02 cs.CV 新提交 57%

Vitality-Aware Compression for Efficient Image-to-Shape Diffusion Transformers

活力感知压缩:面向高效图像到形状扩散Transformer

Jaeah Lee, Hyunjin Kim, Jaewoong Cho, Gihyun Kwon

机构 * KRAFTON AI, Republic of Korea(KRAFTON AI, 韩国) Amazon, Australia(亚马逊, 澳大利亚)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 提出首个针对图像到形状扩散Transformer的压缩方法,通过活力引导的结构化剪枝、自适应量化和微调,在保持几何保真度下实现高达66%的模型尺寸缩减。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00157 2026-07-02 cs.CV 新提交 57%

Progressive Pose-Guided 4D Animal Reconstruction from Monocular Video

渐进式姿态引导的单目视频4D动物重建

Siyuan Li, Weiying Chen, Yilin Wang, Xinxin Zuo, Xingyu Li, Li Cheng

机构 * University of Alberta(阿尔伯塔大学) Concordia University(康科迪亚大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出一种基于3D高斯溅射的渐进式测试时优化框架,通过解耦关节姿态与非刚性变形,实现从单目视频高保真重建4D动物,在多种物种上优于现有方法。

Comments Accepted to ECCV 2026. Camera-ready author version

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01123 2026-07-02 physics.ins-det eess.SP physics.optics 新提交 50%

Plenoptic imaging of particle interactions in scintillation detectors

闪烁体探测器中粒子相互作用的全光成像

Xiang Dai, Chi-Jui Ho, Kevin Tandi, Chang Lee, Alex Bocchieri, David Parra, Forrest Peterson, Talha Sultan, Felicia Sutanto, Andreas Velten, Jingke Xu, Nicholas Antipa

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 提出PRISM多焦点全光成像系统,通过多焦距微透镜阵列平衡光子收集与深度编码,在光子匮乏条件下实现毫米级3D定位,平均误差约1mm。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 5 篇

2607.00885 2026-07-02 cs.CV cs.AI 新提交 92%

Improving Sparse-View 3DGS Generalization via Flat Minima Optimization

通过平坦极小值优化改进稀疏视角3DGS泛化能力

Kangmin Seo, Sangeek Hyun, MinKyu Lee, Jae-Pil Heo

机构 * Sungkyunkwan University(成均馆大学)

专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 针对稀疏视角下3DGS过拟合问题,提出基于平坦极小值优化的轻量训练框架,通过各向异性高斯扰动和周期性重初始化提升泛化性能。

Comments Accepted to ECCV 2026. Project Page: https://kangrnin.github.io/FlatMinGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01200 2026-07-02 cs.RO 新提交 85%

FastBridge: Closing the Model-Based Realization Gap in Safety Filters on 3D Gaussian Splatting for Fast Quadrotor Flight

FastBridge: 缩小基于模型的安全滤波器在3D高斯泼溅用于快速四旋翼飞行中的实现差距

Tscholl Dario, Nakka Yashwanth Kumar, Gunter Brian

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.RO

AI总结 针对快速四旋翼飞行中安全滤波器的模型实现差距,提出一种基于全四旋翼动力学的非线性、执行器感知安全滤波器,利用碰撞锥指数障碍函数和备份CBF,在保持QP可行性的同时降低轨迹加加速度47%并提速2.25倍。

Comments preprint, 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00959 2026-07-02 cs.CV 新提交 79%

GaussianEmoTalker: Real-Time Emotional Talking Head Synthesis with Audio-Driven and Blendshape-Based 3D Gaussian Splatting

GaussianEmoTalker:基于音频驱动和混合形状的3D高斯泼溅实时情感说话头合成

Haijie Yang, Zhenyu Zhang, Yixuan Dong, Jianjun Qian, Jian Yang

机构 * PCA Lab, Key Lab of Intelligent Perception and Systems for High-Dimensional Information of Ministry of Education, School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院,教育部高维信息智能感知与系统重点实验室,PCA实验室) Tsientang Institute for Advanced Study(浙江大学前沿交叉研究院) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 提出GaussianEmoTalker框架,利用3D高斯泼溅和混合形状,通过中性到情感残差变形实现实时、可控强度的情感说话头合成,兼顾唇同步与渲染质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01202 2026-07-02 cs.CV cs.AI cs.GR 新提交 73%

World from Motion: Generative Dynamic Gaussian Reconstruction from Monocular Video

世界源于运动:从单目视频生成动态高斯重建

Liyuan Zhu, Shengyu Huang, Amrita Mazumdar, Tianye Li, Zan Gojcic, Gordon Wetzstein, Iro Armeni, Shalini De Mello, Alex Trevithick

机构 * Stanford University(斯坦福大学) NVIDIA(英伟达)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 提出World from Motion方法,利用视频模型从单目视频生成可自由渲染的动态3D高斯表示,通过像素对齐渲染校正伪影并填充缺失区域,实现4D重建新高度。

Comments Project page: https://research.nvidia.com/labs/amri/projects/world-from-motion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01164 2026-07-02 cs.LG 新提交 50%

Efficient Compression of Structured and Unstructured Volumes via Learned 3D Gaussian Representation

基于学习的三维高斯表示对结构化与非结构化体积的高效压缩

Landon Dyken, Sharmistha Chakrabarti, Nathan Debardeleben, Steve Petruzza, Qi Wu, Will Usher, Sidharth Kumar

专题命中 Gaussian Splatting :novel view synthesis(abstract)

AI总结 提出基于三维高斯原语的显式模型压缩体积数据,通过加权聚合重建标量场,无需网格存储,在非结构化体积上全面超越隐式神经表示。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 6 篇

2607.01015 2026-07-02 cs.CV 新提交 79%

SuperFlex: Deformable Superquadrics for Point Cloud Decomposition

SuperFlex: 用于点云分解的可变形超二次曲面

Gabriel Tavernini, Elisabetta Fedele, Tiago Novello, Leonidas Guibas, Marc Pollefeys, Francis Engelmann

机构 * ETH Zurich(苏黎世联邦理工学院) Stanford University(斯坦福大学) IMPA(巴西国家纯数学与应用数学研究所) USI Lugano(卢加诺大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出SuperFlex框架,通过新损失函数、弯曲和锥形变形提升超二次曲面分解精度,并利用高质量分解训练模型以鲁棒处理部分点云。

Comments Project page: https://superflex3d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00514 2026-07-02 cs.CV cs.AI 新提交 79%

Cross4D-JEPA: Dense Cross-modal Correspondence Distillation for 4D Point Cloud Representation Learning

Cross4D-JEPA: 用于4D点云表示学习的密集跨模态对应蒸馏

Trung Thanh Nguyen, Hai Nguyen-Truong, Tu Vo, Hoang M. Truong, Tuan-Anh Vu

机构 * Nagoya University(名古屋大学) Northeastern University(东北大学) KC Machine Learning Lab(KC机器学习实验室) University of Science, Vietnam National University Ho Chi Minh City(胡志明市越南国立大学理科大学) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出Cross4D-JEPA,通过教师-学生框架将冻结的2D基础模型(如DINOv2或V-JEPA 2)的密集补丁特征蒸馏到4D点编码器,实现每点对应和潜在空间匹配,在四个基准上优于模态内和全局跨模态基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00148 2026-07-02 cs.RO cs.CV 新提交 62%

3D Point World Models: Point Completion Enables More Accurate Dynamics Learning

3D点云世界模型:点云补全实现更准确的动力学学习

Skand Peri, Hung Nguyen, Chanho Kim, Li Fuxin, Stefan Lee

机构 * Oregon State University(俄勒冈州立大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出3D点云世界模型(3DPWM),通过先补全部分点云再学习动作条件动力学,实现长时程可靠推演和精确成本评估,支持多种机器人操作任务。

Comments 21 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00529 2026-07-02 cs.CV 新提交 57%

NoPA: Non-Parametric Online 3D Scene Graph Generation

NoPA: 非参数化在线3D场景图生成

Qi Xun Yeo, Seungjun Lee, Yan Li, Gim Hee Lee

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对现有3D场景图生成方法无法实时运行的问题,提出NoPA,用非参数化分布表示物体,保留几何细节,并通过基于最大均值差异的合并策略和关系传播,实现实时且准确的在线场景图生成。

Comments This paper has been accepted in ECCV 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00215 2026-07-02 cs.RO 新提交 57%

ELMP: Efficient Learning for Motion Planning via Analytical Policy Gradients

ELMP: 通过解析策略梯度实现高效运动规划学习

Yixiao Li, Tifanny Portela, Jordis Herrmann, René Zurbrügg, Marco Hutter

机构 * Robotic Systems Lab, ETH Zürich(苏黎世联邦理工学院机器人系统实验室) ABB(ABB公司) ANYbotics(ANYbotics公司)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出ELMP框架,利用可微运动学层和自监督微调,通过密集碰撞、目标到达和平滑性目标直接优化策略,避免专家数据收集,实现数据高效的运动规划适应。

Comments 8 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00750 2026-07-02 physics.comp-ph 新提交 50%

LSR-Net: Long-Short-Range Operator Learning for Pattern Dynamics on Manifolds

LSR-Net: 用于流形上模式动力学的长短程算子学习

Qian Serena Hou, Zecheng Gan

专题命中 点云 :point cloud(abstract)

AI总结 提出LSR-Net框架,通过分解长程(SOE近似傅里叶乘子)和短程算子,结合高斯网格化与FFT,高效学习平面、球面及一般流形上的模式动力学,在多个基准系统上精度和稳定性优于基线模型。

Comments 27 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 3D生成 1 篇

2607.01222 2026-07-02 cs.CV 新提交 57%

Ink3D: Sculpting 3D Assets with Extremely Complex Textures via Video Generative Models

Ink3D: 通过视频生成模型雕刻具有极其复杂纹理的3D资产

Yue Han, Chong Li, Zhening Liu, Cong Huang, Fang Deng, Yong Liu, Fangyun Wei, Yan Lu

机构 * ZGCA & ZGCI(ZGCA 和 ZGCI) Microsoft Research(微软研究院) Zhejiang University(浙江大学) HKUST(香港科技大学)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV

AI总结 提出Ink3D框架,利用大规模视频生成模型合成复杂纹理,通过OrbitPainter生成密集轨道扫描视频,并用TextureOptimizer进行神经烘焙以生成一致纹理。

Comments Accepted to ECCV 2026. Project page: https://yuehan99.github.io/Ink3D-TextureGen/

详情

展开后加载摘要…

URL PDF HTML 收藏

5. SLAM与定位 1 篇

2607.00881 2026-07-02 cs.CV 新提交 57%

OmniView-Space: Reinforcing Spatial Reasoning via Multi-Perspective Spatial Mapping

OmniView-Space: 通过多视角空间映射增强空间推理

Xudong Li, Mengdan Zhang, Peixian Chen, Jiaxi Tan, Zihao Huang, Jingyuan Zheng, Yan Zhang, Xiawu Zheng, Xing Sun, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(厦门大学多媒体可信感知与高效计算教育部重点实验室) Tencent Youtu Lab(腾讯优图实验室) Beijing Institute of Technology(北京理工大学)

专题命中 SLAM与定位 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出OmniView-Space框架,通过多视角空间映射、工具引导的自我中心推理和认知图蒸馏,解决多模态大模型在多步空间推理中的参考框架动态重锚问题,在单/多图像基准上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏