arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-28 至 2026-07-28 共收录 22 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 5 篇

2607.24233 2026-07-28 cs.RO 新提交 79%

Quality-Adaptive Multi-UAV 3D Reconstruction with Sparse Workload Redistribution

基于稀疏工作负载重新分配的质量自适应多无人机三维重建

Benjamin Sportich, Kenza Boubakri, Olivier Simonin, Alessandro Renzaglia

机构 * Inria, INSA Lyon, CITI(法国国家信息与自动化研究所、里昂国立应用科学学院、CITI)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.RO

AI总结 针对无人机三维重建中计算和能量受限及协调难问题,提出质量自适应分散决策策略,集成质量导向准则,采用两级协调,仿真显示该方法提高路径效率且实现更高保真度重建,代码公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24436 2026-07-28 cs.CV 新提交 74%

MSVS-VAE: Multi-Scale Anchored VecSet for High-Fidelity 3D Reconstruction

MSVS-VAE:用于高保真3D重建的多尺度锚定向量集

Dehao Hao, Kaiyi Zhang, Tanghui Jia, Xiangjun Gao, Dongyu Yan, Weikai Chen, Zeyu Hu, Lingting Zhu, Yingda Yin, Runze Zhang, Li Yuan, Xin Wang, Long Quan

机构 * The Hong Kong University of Science and Technology(香港科技大学) Peking University(北京大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Lightspeed Studios(光速工作室)

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 研究针对高保真3D重建中VAE的瓶颈问题,提出MSVS-VAE。通过分层点洗牌上采样 densify 锚定向量集潜在特征,用AVS-Conv取代全局交叉注意力,引入多尺度查询解码融合特征,实验表明其性能优于现有方法,解码速度和紧凑性有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24591 2026-07-28 cs.CV 新提交 57%

CameraAnything: Refilming Videos with Arbitrary Camera Control

CameraAnything:使用任意相机控制重新拍摄视频

Yixuan Li, Yanhong Zeng, Ka Leong Cheng, Jiayi Zhu, Hanlin Wang, Wen Wang, Yihao Meng, Hao Ouyang, Qiuyu Wang, Yue Yu, ZiDong Wang, Yiyuan Zhang, Yujun Shen, Dahua Lin

机构 * The Chinese University of Hong Kong(香港中文大学) Ant Group(蚂蚁集团) Tsinghua University(清华大学) Zhejiang University(浙江大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 CameraAnything是用于相机控制视频编辑的统一框架,采用逐像素普吕克光线注入等方法联合控制相机参数,开发合成管道克服数据稀缺,能在单过程中实现多种视频编辑操作,为视频制作提供实用价值。

Comments Project page: https://yixuanli98.github.io/cameraanything/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23758 2026-07-28 cs.CV 新提交 57%

RoadVGGT: Road-Structure-Aware Feed-Forward Road Surface Reconstruction

RoadVGGT:基于道路结构感知的前馈式路面重建

Han Jiao, Chen Liu, Jiakai Sun, Zhanjie Zhang, Mengyuan Yang, Yimeng Li, Mofan Zhou, Kun Zhan, Lei Zhao

专题命中 三维重建 :novel view synthesis(abstract);分类 cs.CV

AI总结 针对现有道路重建方法需逐场景训练及场景依赖覆盖设计的局限,提出RoadVGGT框架,利用几何基础模型结合多视图图像等,经高斯头预测、坐标对齐及融合等重建紧凑高斯路面,提升多方面性能,证明几何基础模型在路面重建中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22773 2026-07-28 eess.IV cs.CV physics.med-ph 新提交 57%

Metric Surface Reconstruction of Neurosurgical Scenes from Monocular Operating Microscope Images and Microscope Pose

从单目手术显微镜图像和显微镜位姿重建神经外科场景的度量曲面

Thomas Bucher, Didier Neuenschwander, Thomas Petutschnigg, Michael Murek, David Bervini, Andreas Raabe, Manuela Eugster

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 研究能否从单目手术显微镜图像和位姿数据重建神经外科场景的三维几何度量,利用预训练模型估计深度、泊松曲面重建点云成网格,结果显示该方法在模型设置中有技术可行性,支持相关手术技术进一步发展。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2607.24538 2026-07-28 cs.RO 新提交 90%

NEO: NeRF It Once, Edit It Many Times for Continuous Object Manipulation

NEO:一次性NeRF,多次编辑以进行连续物体操纵

Mikołaj Zieliński, David Hall, Dominik Belter, Peyman Moghadam

机构 * Institute of Robotics and Machine Intelligence, Poznan University of Technology(波兹南理工大学机器人与机器智能研究所) CSIRO Robotics, CSIRO(联邦科学与工业研究组织机器人部)

专题命中 NeRF :NeRF(title,title_cn);分类 cs.RO

AI总结 本文提出NEO框架,用于机器人操纵的语言引导NeRF编辑。结合神经场重采样与多视图修复实现物体移除,利用知识蒸馏进行NeRF权重编辑,还创建了评估基准NEO-Dataset。该方法在场景编辑任务中表现出色,优于现有基线。

Comments Accepted to IEEE ROBOTICS AND AUTOMATION LETTERS (RA-L) JULY, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 8 篇

2607.22890 2026-07-28 cs.GR cs.CV cs.LG 新提交 86%

Meshless Domain Randomization via Explicit Parameter Perturbation of 3D Gaussian Splatting

通过显式参数扰动3D高斯喷溅实现无网格域随机化

Felipe Nunes Carbone de Carvalho, Joyce de Morais Souza, Alan de Aguiar, Charles Morphy D. Santos, João Paulo Gois

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 针对复杂有机物体提取和渲染纹理网格的挑战,提出基于3D高斯喷溅参数空间的无网格域随机化框架,用两个独立扰动管道合成随机训练数据集,为复杂几何形状生成强大数据集提供无网格替代方法。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24403 2026-07-28 cs.CV 新提交 85%

GenSplatCodec: Feed-Forward Gaussian Splatting Compression via One-Step Diffusion

GenSplatCodec:通过一步扩散实现前馈高斯点云压缩

Qiang Hu, Zhenlong Wu, Lei Huang, Zihan Zheng, Xiaoyun Zhang, Wenjun Zhang

机构 * Cooperative Medianet Innovation Center, Shanghai Jiao Tong University(上海交通大学协同媒体网络创新中心)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 研究针对前馈3D高斯点云压缩难题,提出GenSplatCodec统一编解码器,采用双流编码与几何引导生成解码,经三阶段优化策略,在多数据集实验中展现出优于现有方法的率失真性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22956 2026-07-28 cs.GR cs.DC 新提交 83%

3D Gaussian Splatting for Scientific Particle Data Compression and Rendering

用于科学粒子数据压缩与渲染的3D高斯点渲染

Bo Jiang, Youyuan Liu, Taolue Yang, Sheng Di, Sian Jin

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.GR

AI总结 针对大规模粒子模拟带来的存储等压力及现有压缩器问题,提出基于3D高斯点渲染的ParticleGS框架,结合多种技术,在HACC模拟中表现出色,压缩率高且渲染速度快,并能推广到其他模拟。

Comments 13 pages, 13 figures. Accepted at SC26 (The International Conference for High Performance Computing, Networking, Storage and Analysis)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22780 2026-07-28 cs.GR cs.CV 新提交 81%

Inter-Reflective Gaussian Splatting for Robust and Efficient Inverse Rendering

用于鲁棒高效逆渲染的互反射高斯点渲染

Chun Gu, Xiaofei Wei, Zixuan Zeng, Yuxuan Yao, Li Zhang

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV、cs.GR

AI总结 研究逆渲染问题,提出IRGS++框架,通过可微二维高斯光线追踪等技术,能实时查询可见性和间接辐射,评估互反射传输方程,纳入金属感知材料建模等,在低光泽和光泽基准测试及实际研究中表现良好,提升逆渲染质量与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23861 2026-07-28 cs.CV cs.GR 新提交 79%

Head Avatars with Dynamic Explicit Hair

具有动态显式头发的头部头像

Vanessa Sklyarova, Haonan Chen, Berna Kabadayi, Tobias Kirschstein, Zicong Fan, Xi Wang, Gerard Pons-Moll, Matthias Nießner, Marc Pollefeys, Michael J. Black, Justus Thies

机构 * ETH Zürich(苏黎世联邦理工学院) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) Max Planck Institute for Informatics(马克斯·普朗克信息研究所) Tübingen AI Center(图宾根人工智能中心) Technical University of Munich(慕尼黑工业大学) Technical University of Darmstadt(达姆施塔特工业大学) Microsoft(微软)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 该研究提出DynHair方法,用于跟踪和建模人类头部头像的动态头发。通过结构化3D高斯喷绘重建头像,利用基于头部角速度等的时间网络建模发丝动态变形,经联合优化获得可控头发动力学的动画头像,实验展现了最优性能。

Comments Project page: https://dynhair.is.tue.mpg.de/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22717 2026-07-28 cs.CV 新提交 77%

TOM-GS: Editable Video Representation via Temporal Opacity Modulation of Static 3D Gaussians

TOM-GS:通过静态3D高斯的时间不透明度调制实现可编辑视频表示

Marek Lisowski, Łukasz Smoliński, Kornel Howil, Piotr Biliński, Marcin Mazur, Przemysław Spurek

机构 * University of Warsaw(华沙大学) Jagiellonian University(雅盖隆大学) IDEAS Research Institute(IDEAS 研究所)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对视频表示难以编辑的问题,提出TOM-GS方法,通过为3D高斯的不透明度赋予可学习参数,结合姿态估计保持静态空间几何,实现可编辑视频表示,在视觉保真度上超越同类,且与3D编辑工具兼容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22997 2026-07-28 cs.RO cs.AI cs.GR cs.LG 新提交 73%

Real2Sim2Real for Vision-Language-Action Manipulation: An AMD ROCm-Based Pipeline

用于视觉-语言-动作操纵的Real2Sim2Real:基于AMD ROCm的管道

Qing Yang, Xun Wang, Ziguan Wang, Zhenjiang Li, Hongqiang Wang, Dongdong Weng

机构 * AMD AIG Team(AMD人工智能团队) Beijing Institute of Technology(北京理工大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.GR、cs.RO

AI总结 本文针对视觉-语言-动作操纵提出基于AMD ROCm的Real2Sim2Real技术栈,涵盖多硬件计算,由开放软件栈统一。通过四个演示表明无需CUDA锁定生态系统,展示了在多硬件平台上的相关成果,且管道可在特定硬件和平台上原生运行并重现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23189 2026-07-28 cs.CV cs.AI 新提交 70%

Fashion-3DLR: A Controllable 3D Garment Generation Using Pairwise Fashion Elements for Intelligent Design

Fashion-3DLR:一种使用成对时尚元素进行智能设计的可控3D服装生成方法

Shenghao Yang, Hongtao Zhang, Yuhan Yi, Zhihao Tang, Zihao Cui, Lian Wen, Han Yan, Yuan Gao, Mingbo Zhao

机构 * Donghua University(东华大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 研究针对3D服装生成难题,提出Fashion-3DLR框架,通过GFF-DiT模块融合2D时尚设计元素,利用整流流Transformer生成几何潜在值,实现多种3D服装表示,并集成到下游任务,实验证明其超越现有方法,有成为通用3D服装设计工具的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 7 篇

2607.23096 2026-07-28 cs.CV 新提交 79%

SHReg: Strictly Rotation-Equivariant Point Cloud Registration via Spherical Harmonics

SHReg:通过球谐函数实现严格旋转等变的点云配准

Chongjian Wang, Junjie Gao

机构 * College of Mathematics and Systems Science, Shandong University of Science and Technology(山东科技大学数学与系统科学学院) School of Artificial Intelligence, Shandong Women’s University(山东女子学院人工智能学院)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 研究提出基于$SO(3)$表示理论的SHReg框架,将局部几何特征表示为$SO(3)$不可约表示,基于球谐函数等变主干联合学习旋转不变描述符与等变特征,减少对大规模假设采样依赖,在点云配准精度上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24074 2026-07-28 cs.AI 新提交 78%

MiSS: A Logic-Driven Explanation of Minimal Sufficient Coalitions for Point Cloud Classifiers

MiSS:点云分类器最小充分联盟的逻辑驱动解释

Mengda Xing, Jean-Marie Lagniez

专题命中 点云 :point cloud(title,abstract)

AI总结 研究针对3D点云分类器,提出MiSS框架,通过扰动相对充分性推理来解释。该框架将候选提议与验证分开,由加权MaxSAT过程提议联盟,黑盒统计预言机确定充分性,实验表明其在精度、覆盖率和解释时间上优于基于规则的基线和穷举搜索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23910 2026-07-28 cs.CV cs.LG cs.MA cs.RO 新提交 62%

SimBEV2X: A Large-Scale Dataset and Data Generation Tool for Multi-Task Vehicle-to-Everything Cooperative Perception

SimBEV2X:用于多任务车联网协同感知的大规模数据集与数据生成工具

Goodarz Mehr, Sepideh Gohari, Montasir Abbas, Azim Eskandarian

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 研究针对V2X协同感知算法发展受限问题,介绍基于CARLA模拟器的SimBEV2X数据生成工具及数据集,通过它建立基线并提出CoBEVFusion架构,实现上下文感知多智能体特征聚合,性能优越。

Comments Submitted to IEEE for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22963 2026-07-28 eess.IV cs.CV 新提交 57%

PriSAR: 3D Geometric-Prior-Guided Diffusion for Parameter-Controlled SAR Image Generation

PriSAR:用于参数控制SAR图像生成的3D几何先验引导扩散

Fan Zhang, Xuanting Wu, Fei Ma, Qiang Yin, Yuxin Hu

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究SAR图像在稀疏观测角度下的可控生成问题,提出用3D模型导出的几何先验引导扩散模型的方法,即GeoDiff-SAR,经实验在飞机和车辆数据集上取得较好结果,证明该轻量级3D几何先验可改善视点一致性,用作生成指导。

Comments 17 pages,15 images

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23958 2026-07-28 cs.CV 新提交 57%

RODR: Riemannian Orthogonally Decoupled Regularization for Disentangled Manifold Representation

RODR:用于解缠流形表示的黎曼正交解耦正则化

Jiayu Zhu, Wenlai Zhao

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究点云去噪中目标与几何不匹配问题,提出黎曼正交解耦正则化(RODR),通过解耦法向和切向分量重新制定优化轨迹,实验表明其性能与基线相当,能改善分布规律、减少局部聚集,建立了解缠几何优化框架。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23192 2026-07-28 math.NA cs.LG cs.NA 新提交 50%

Data-Driven Diffusion Processes on Differential Forms via the Projected Ambient Connection Laplacian

通过投影环境联络拉普拉斯算子在微分形式上进行数据驱动的扩散过程

Alvaro Almeida Gomez, Jorge Duque Franco

专题命中 点云 :point cloud(abstract)

AI总结 研究如何通过投影环境联络拉普拉斯算子对微分形式进行数据驱动的扩散过程,基于新颖表示构造矩阵值扩散算子,有渐近最优核带宽缩放,推导显式欧拉格式并经数值实验验证,为几何偏微分方程数值逼近奠定基础。

Comments Comments are welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23299 2026-07-28 physics.comp-ph 新提交 50%

PI-GINOT: Data-free geometry-informed neural operator learning for finite-strain hyperelasticity on parametric DogBone specimens

PI-GINOT:用于参数化狗骨形试件有限应变超弹性的无数据几何信息神经算子学习

Aamir Dean, Betim Bahtiri

专题命中 点云 :point cloud(abstract)

AI总结 研究针对参数化非线性固体力学模拟成本高的问题,提出PI-GINOT这一无数据几何信息神经算子,通过特定方法预测狗骨形试件有限应变超弹性响应,经训练和验证,在多个测试几何形状上取得一定精度结果,揭示了局部应力分辨率待提升之处。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 3D生成 1 篇

2607.24298 2026-07-28 cs.CV 新提交 79%

UMI3D: Robust 3D Generation on Unconstrained Multi-Image Inputs via Simultaneous Focus Cross-Attention Routing

UMI3D:通过同步聚焦交叉注意力路由在无约束多图像输入上进行稳健的3D生成

Zefan Qu, Zhenwei Wang, Gerhard Petrus Hancke, Rynson W. H. Lau

专题命中 3D生成 :3D generation(title,abstract);分类 cs.CV

AI总结 研究针对3D基础模型在无约束多图像输入上表现不佳的问题,提出UMI3D框架,通过同步聚焦交叉注意力路由,利用体素参考分数,无需训练即可提升单图像3D生成框架在多图像输入时的性能。

Comments Project Page: https://umi3d-project.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏