arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-09 至 2026-06-09 共收录 20 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 5 篇

2606.08440 2026-06-09 cs.RO cs.CV 新提交 73%

GraspFoM: Towards Reconstruction-Driven Robotic Grasping with 3D Foundation Priors

GraspFoM:基于3D基础先验的重建驱动机器人抓取

Dongli Wu, Xiaobao Wei, Hao Wang, Qiaochu Dong, Ying Li, Qingpo Wuwu, Ming Lu, Wufan Zhao

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Peking University(北京大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 三维重建 :3DGS(abstract,abstract_cn);分类 cs.CV、cs.RO

AI总结 提出GraspFoM框架,利用3D基础先验(SAM3D)构建共享3D物体潜变量,联合优化重建与抓取姿态预测,通过锚点初始化的截断姿态推理扩散器生成连续多模态抓取,实现高保真重建与最优抓取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08957 2026-06-09 cs.CV 新提交 57%

Rethinking 3D Shape Generation: Diffusion over Superquadrics

重新思考3D形状生成:超二次曲面上的扩散

Zhiyang Liu, Wanze Li, Yuwei Wu, Chengran Yuan, Jiawei Sun, Rui Zheng, Marcelo H Ang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 提出将扩散模型从高基数几何表示转移到紧凑的超二次曲面参数上,以降低计算和内存成本,并支持无分辨率点云解码、部件级编辑和约束设计,实现高效生成。

Comments Accepted to ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08205 2026-06-09 cs.CV 新提交 57%

Empowering Feed-Forward Reconstruction Models with Metric Scale via Satellite Images

利用卫星图像赋予前馈重建模型度量尺度

Xianghui Ze, Yongjian Luo, Mengjun Chao, Zhenbo Song, Jianfeng Lu, Yujiao Shi

机构 * Nanjing University of Science and Technology(南京理工大学) ShanghaiTech University(上海科技大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出卫星引导框架,通过双向交叉视图交互利用卫星图像作为全局度量参考,解决前馈3D重建中的尺度模糊问题,实现度量深度估计、点云重建和相机定位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07907 2026-06-09 cs.CV cs.AI 新提交 57%

3D Oral Modelling with Improved Vertex Distribution Using Matching-Based Learning

基于匹配学习的改进顶点分布的3D口腔建模

Jihun Cho, Soo-Yeon Jeong, Eun-Jeong Bae, Sun-Young Ihm

机构 * st Jihun Cho(第一作者) nd Soo-Yeon Jeong(第二作者) rd Eun-Jeong Bae(第三作者) th Sun-Young Ihm(第四作者)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 针对3D口腔重建中预测顶点分布不均的问题,提出结合匈牙利匹配过滤与排斥损失的改进损失函数,使顶点分布更均匀,虽精度略降但有效缓解了聚集现象。

Comments 5 pages, 7 figures. English version of a paper presented at the Korea Multimedia Society Conference, November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07891 2026-06-09 cs.CV 新提交 57%

C3VD-DEFCOL: A Deformable Colonoscopy Dataset with Time-Resolved 3D Ground Truth and Realistic Appearance

C3VD-DEFCOL:具有时间分辨三维真实地面真值和逼真外观的可变形结肠镜数据集

Ethan Luk, Mayank V. Golhar, Anthony Song, Raúl Iranzo, Víctor M. Batlle, Lalithkumar Seenivasan, José M. M. Montiel, Nicholas J. Durr

机构 * Johns Hopkins University(约翰霍普金斯大学) Universidad de Zaragoza(萨拉戈萨大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出C3VD-DEFCOL框架和数据集,通过模拟蠕动变形和真实纹理渲染,为可变形结肠镜三维重建提供带时间分辨地面真值的评估平台。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 4 篇

2606.09034 2026-06-09 cs.CV 新提交 95%

Leveraging NeRF-Rendered Images for 3D Gaussian Splatting

利用NeRF渲染图像进行3D高斯泼溅

Mizuki Morikawa, Yuta Shimizu, Chunyu Li, Yusuke Monno, Masatoshi Okutomi

机构 * Institute of Science Tokyo(东京科学研究所)

专题命中 Gaussian Splatting :NeRF(title,title_cn);3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);novel view synthesis(abstract)

AI总结 提出利用NeRF渲染图像辅助3DGS训练,通过去除瞬态物体和生成鸟瞰视图,结合扩散增强,在保持3DGS速度的同时提升街景渲染质量。

Comments ICIP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07670 2026-06-09 cs.CV cs.AI 新提交 89%

Liquid Neural Networks as a Drop-in Continuous-Time Deformation Field for Dynamic 3D Gaussian Splatting

液态神经网络作为动态3D高斯泼溅的即插即用连续时间变形场

Mingzhao Li, Arghya Pal, Guan Yuan Tan

机构 * Monash University(莫纳什大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);NeRF(abstract,abstract_cn);3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 提出用液态神经网络(LNN)的闭式连续时间(CfC)单元替代MLP,构建显式连续时间变形场,在动态场景重建中匹配或超越MLP基线,尤其擅长高频关节运动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07932 2026-06-09 cs.CV cs.GR cs.MM eess.IV math.OC 新提交 88%

LEGS: Laplacian-Enhanced Gaussian Splatting with a Nonlinear Weighted Loss

LEGS: 拉普拉斯增强的高斯泼溅与非线性加权损失

Yongfei Guo, Qizhou Huo, Xuan Sun, Yuanhao Gong

机构 * Changchun Institute of Optics, Fine Mechanics and Physics, Chinese Academy of Sciences(中国科学院长春光学精密机械与物理研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);novel view synthesis(abstract);分类 cs.CV、cs.GR

AI总结 提出LEGS方法,利用二阶拉普拉斯结构引导和非线性权重函数改进高斯泼溅的损失函数,在保持渲染管线不变的情况下提升结构感知优化,在Tanks&Temples和Mip-NeRF360数据集上PSNR最高提升1.68 dB。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09018 2026-06-09 cs.GR 新提交 79%

MaterialClusterGS: Palette-Based Material Decomposition and Physically-Based Relighting with 2D Gaussian Splatting

MaterialClusterGS: 基于调色板的材质分解与基于物理的2D高斯泼溅重光照

Hao Zhang, Ang Li, Boyan Du, Junke Zhu, Fei Zhu, Meng Gai, Zhangjin Huang, Guoping Wang, Sheng Li

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.GR

AI总结 提出MaterialClusterGS框架,通过共享BRDF原型调色板和连续空间材质场,实现2D高斯泼溅的物理重光照与材质编辑,解决逐基元分解的不一致问题。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 8 篇

2606.09111 2026-06-09 cs.CV 新提交 79%

Illumination-Invariant Anomaly Detection for Sub-Canopy UAV Multispectral Point Clouds

林冠下无人机多光谱点云的照度不变异常检测

Likun Chen, Yanfeng Gu, Xian Li

机构 * School of Electronics and Information Engineering(电子信息工程学院) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 针对植被阴影导致的严重光照异质性,提出无先验异常检测框架,通过太阳角度估计与照度一致稀疏表示,有效分离暗目标与真实阴影,提升复杂森林环境中异常与背景的可分离性。

Comments 5 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07938 2026-06-09 cs.CV cs.MM eess.IV 新提交 79%

DAL-PCQA: Enabling Distortion-Level and Language-Driven Reasoning for Point Cloud Quality Assessment

DAL-PCQA:实现点云质量评估的失真级别与语言驱动推理

Swarna Chakraborty, Gabriel De Castro Araújo, Syeda Tasmi Faria, Marcelo M. Carvalho, Mylene C. Q. Farias

机构 * University of Brasília(巴西利亚大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出DAL-PCQA数据集,通过多级失真标签、质量类别和自然语言描述,结合零样本与微调多模态模型,实现可解释的点云质量评估。

Comments Accepted at Qomex 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08844 2026-06-09 cs.CV cs.RO 新提交 62%

Geometry-Aware Fisheye-LiDAR Fusion for Robust 3D Object Detection in Low-Overlap Setups

几何感知鱼眼-激光雷达融合用于低重叠设置下的鲁棒3D目标检测

Xiangzhong Liu, Xihao Wang, Hao Shen

机构 * Technical University of Munich(慕尼黑工业大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 针对稀疏视角下鱼眼相机与激光雷达的几何畸变和低重叠问题,提出几何感知混合融合框架,通过畸变感知LSS模块和双注意力校正模块实现极坐标与笛卡尔特征融合,在三个基准上提升检测精度。

Comments 8 pages, 4 figures, submitted to RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09828 2026-06-09 cs.CV 新提交 57%

Latent Spatial Memory for Video World Models

视频世界模型的潜在空间记忆

Weijie Wang, Haoyu Zhao, Yifan Yang, Feng Chen, Zeyu Zhang, Yefei He, Zicheng Duan, Donny Y. Chen, Yuqing Yang, Bohan Zhuang

机构 * Zhejiang University(浙江大学) Microsoft Research(微软研究院) Adelaide University(阿德莱德大学) Monash University(莫纳什大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出潜在空间记忆框架Mirage,通过在扩散潜在空间中直接构建和查询3D缓存,避免像素空间重建,实现高效视频生成,速度提升10.57倍,内存减少55倍。

Comments Project Page: https://aka.ms/latent-spatial-memory, Code: https://github.com/microsoft/LatentSpatialMemory

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09314 2026-06-09 cs.RO 新提交 57%

KPGrasp: Scalable Keypoint Flow Matching for Dexterous Grasp Generation

KPGrasp: 可扩展的关键点流匹配用于灵巧抓取生成

Yuansen Huang, Jiayi Chen, Haoran Liu, Yubin Ke, Bing Han, Jiangran Lyu, Mi Yan, Li Yi, He Wang

机构 * Peking University(北京大学) Galbot Xi’an Jiaotong University(西安交通大学) Tsinghua University(清华大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出KPGrasp框架,通过全欧几里得手部关键点参数化和Transformer流模型,从大规模数据学习灵巧抓取先验,无需接触损失或测试时优化,在模拟和真实场景中实现高成功率与低穿透深度。

Comments 14 pages, 7 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08828 2026-06-09 cs.RO 新提交 57%

Video2Sim2Real: Full-Stack Autonomous Dexterous Skill Acquisition from a Single Human Video

Video2Sim2Real:从单个人类视频实现全栈自主灵巧技能获取

Yunhai Han, Jianuo Qiu, Linhao Bai, Ziyu Xiao, Zihang Zeng, Yangcen Liu, Zhaodong Yang, Shalin Jain, Wenrui Ma, Jiaqi Fu, Yuqian Zheng, Manisha Natarajan, Muhammad Zubair Irshad, Kenneth Shaw, Matthew Gombolay, Zsolt Kira, Harish Ravichandar

机构 * Georgia Institute of Technology(佐治亚理工学院) University of Pennsylvania(宾夕法尼亚大学) Toyota Research Institute(丰田研究所) Carnegie Mellon University(卡内基梅隆大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出Video2Sim2Real框架,从单个人类操作视频中重建数字孪生并提取运动先验,通过物体关键帧优化机器人配置,结合残差强化学习与碰撞感知规划,实现从仿真到真实世界的灵巧技能迁移。

Comments Website: https://video2sim2real.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08014 2026-06-09 cs.CV cs.AI 新提交 57%

GVC-Seg: Training-Free 3D Instance Segmentation via Geometric Visual Correspondence

GVC-Seg: 基于几何视觉对应的免训练3D实例分割

Liang Xu, Fangjing Wang, Jinyu Yang, Feng Zheng

机构 * Victoria University of Wellington(惠灵顿维多利亚大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Southern University of Science and Technology(南方科技大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出GVC-Seg,一种免训练的3D实例分割方法,通过几何与视觉特征对应消除多模型集成中的置信度偏差,在多个基准上达到最优性能。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08796 2026-06-09 cs.CE 新提交 50%

A Non-Overlapping Schwarz Hybrid Finite Element-Neural Operator Framework for Solid Mechanics on Irregular Domains

不规则区域固体力学的一种非重叠Schwarz混合有限元-神经算子框架

Wei Wang, Abhinav Gupta, Haihui Ruan, Somdatta Goswami

专题命中 点云 :point cloud(abstract)

AI总结 提出非重叠Schwarz交替法结合Neumann-Dirichlet界面交换,消除重叠层并减少内迭代;Point-DeepONet处理不规则几何,从位移算子解析导出应变应力算子,降低参数量并保证力学一致性。

Comments 40 Pages,19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 3D生成 1 篇

2606.09187 2026-06-09 cs.CV 新提交 57%

CP4D: Compositional Physics-aware 4D Scene Generation

CP4D: 组合式物理感知4D场景生成

Hanxin Zhu, Cong Wang, Tianyu He, Long Chen, Xin Jin, Chen Gao, Zhibo Chen

机构 * School of Information Science and Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学) Zhongguancun Academy(中关村学院) the State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,中国科学院自动化研究所) Eastern Institute of Technology(东部技术研究所) Tsinghua University(清华大学)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV

AI总结 提出CP4D范式,通过静态环境与物理动态对象组合,结合物理模拟器与视频扩散模型生成轨迹,实现高保真、物理一致的4D场景。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 其他3D视觉 2 篇

2606.07775 2026-06-09 cs.CV 新提交 57%

DALE-CT: Depth-Aware Foundation Models for Computed Tomography

DALE-CT: 用于计算机断层扫描的深度感知基础模型

Evan W. Damron, Mahmut S. Gokmen, Mitchell A. Klusty, Caroline N. Leach, Emily B. Collier, V. K. Cody Bumgardner

机构 * University of Kentucky(肯塔基大学)

专题命中 其他3D视觉 :3D vision(abstract);分类 cs.CV

AI总结 提出DALE-CT,一种基于LeJEPA的2D切片模型,通过3D深度感知预训练(利用解剖掩膜和异常标注)提升表示质量,在CT多异常检测中达到与3D视觉语言模型近似的性能。

Comments 9 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07529 2026-06-09 cs.CL cs.AI cs.CV cs.LG cs.MM 新提交 57%

CAPruner: Conceptual-Adjacent Scene Graph Pruner for Enhancing 3D Spatial Reasoning of Large Language Models

CAPruner: 概念相邻场景图剪枝器以增强大语言模型的3D空间推理

Shengli Zhou, Xiangchen Wang, Guanhua Chen, Feng Zheng

机构 * Southern University of Science and Technology(南方科技大学) SpatialTemporal AI(时空人工智能)

专题命中 其他3D视觉 :3D vision(abstract);分类 cs.CV

AI总结 提出概念相邻场景图剪枝器(CAPruner),通过融合模糊语义相关性和空间邻近性估计关系重要性,在任务特定上下文中选择关键关系,避免关系级标注,显著提升大语言模型在3D视觉语言任务上的空间推理性能。

Comments Accepted by ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏