arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-01 至 2026-07-01 共收录 42 信号源:cs.CV, cs.GR, cs.RO

1. 点云 11 篇

2606.31895 2026-07-01 cs.CV 新提交 57%

RESOLVE: A Multi-Resolution and Multi-Modal Dataset for Roadside Cooperative Perception

RESOLVE:用于路边协同感知的多分辨率多模态数据集

Shaozu Ding, Linan Song, Marco De Vincenzi, Dajiang Suo

机构 * The Polytechnic School, Arizona State University(亚利桑那州立大学理工学院) Department of Computer Science and Engineering, New York University(纽约大学计算机科学与工程系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出RESOLVE数据集,包含多分辨率LiDAR和相机-LiDAR同步数据,用于评估路边3D检测与跟踪中的单模态与融合架构,揭示多模态融合如何补偿LiDAR点稀疏性。

Comments Accepted to ECCV 2026. Including supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31579 2026-07-01 cs.GR 新提交 57%

DualBrep: A Dual-Field Continuous Representation for B-rep Modelling

DualBrep:用于B-rep建模的双场连续表示

Yilin Liu, Pradeep Jayaraman, Chinthala Reddy, Xiang Xu, Hooman Shayani

专题命中 点云 :point cloud(abstract);分类 cs.GR

AI总结 提出DualBrep,通过有符号距离函数和无符号距离场双场统一B-rep的几何与拓扑,结合隐空间流匹配实现无误差累积的生成建模,并支持从点云逆向工程和生成建模。

Comments Published in SIGGRAPH 2026; Code is available at https://github.com/AutodeskAILab/DualBrep

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31570 2026-07-01 cs.CV cs.AI 新提交 57%

Mitigating Positional Leakage in 3D Masked Autoencoders for Robust Representation Learning

缓解3D掩码自编码器中的位置泄漏以实现鲁棒表示学习

Xu Yan, Huiqun Wang, Chen Wang, Lei Ren, Di Huang

机构 * SKLCCSE, Beihang University(北京航空航天大学软件开发环境国家重点实验室) SCSE, Beihang University(北京航空航天大学计算机学院) NERCBDS, EIRI, Tsinghua University(清华大学电子工程系智能技术与系统国家重点实验室) SASEE, Beihang University(北京航空航天大学自动化科学与电气工程学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对3D掩码自编码器中位置信息过度依赖导致语义表示弱化的问题,提出MPL-MAE框架,通过重校准位置嵌入和门控位置接口模块,平衡空间先验与语义特征,提升下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31148 2026-07-01 cs.CV cs.AI cs.CL 新提交 57%

PruneGround: Plug-and-play Spatial Pruning for 3D Visual Grounding

PruneGround: 用于3D视觉定位的即插即用空间剪枝框架

Duc Cao Dinh, Khai Le-Duc, Florent Draye, Chris Ngo, Terry Jingchen Zhang, Bernhard Schölkopf, Zhijing Jin

机构 * Knovel Engineering Lab(Knovel工程实验室) University of Toronto(多伦多大学) Vector Institute(向量研究所) ELLIS Institute(ELLIS研究所) Max Planck Institute(马克斯·普朗克研究所)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出PruneGround框架,通过语言引导的空间剪枝、多视角描述重构和LLM定位器,在剪枝区域高效定位目标,在多个基准上取得最优结果。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31136 2026-07-01 cs.CV 新提交 57%

FROST: Training-Free Few-Shot Segmentation with Frozen Features and Nonparametric Statistics

FROST:基于冻结特征和非参数统计的无训练少样本分割

Junghwan Park

机构 * TelePIX

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出FROST,一种无训练少样本分割方法,将参考前景和背景视为冻结DINOv3特征单位球上的点云,通过非参数密度比标记查询像素,在遥感基准上超越现有方法。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 新视角合成 5 篇

2603.14965 2026-07-01 cs.CV 版本更新 79%

GeoNVS: Geometry Grounded Video Diffusion for Novel View Synthesis

GeoNVS: 基于几何的视频扩散模型用于新视角合成

Minjun Kang, Inkyu Shin, Taeyeop Lee, Myungchul Kim, In So Kweon, Kuk-Jin Yoon

机构 * KAIST, South Korea(韩国科学技术院) Luma AI, USA(Luma AI(美国))

专题命中 新视角合成 :novel view synthesis(title,abstract);分类 cs.CV

AI总结 提出GeoNVS,通过高斯溅射特征适配器将扩散特征提升为3D高斯表示,增强几何保真度和相机可控性,在新视角合成任务上超越现有方法。

Comments The code will be available at https://sites.google.com/view/minjun-kang/geonvs-eccv26 (ECCV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31258 2026-07-01 cs.CV 新提交 77%

WarpHammer: Densifying Scene Warps with 3D Object Priors for Extreme View Synthesis

WarpHammer: 利用3D物体先验稠密化场景扭曲以实现极端视角合成

Michael Green, Gavriel Habib, Dvir Samuel, Tal Berkovitz Shalev, Issar Tzachor, Rami Ben-Ari, Or Litany

机构 * OriginAI, Israel(OriginAI,以色列) NVIDIA(英伟达) Technion(以色列理工学院)

专题命中 新视角合成 :3D reconstruction(abstract);point cloud(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 针对投影条件新视角合成在大轨道运动下扭曲稀疏导致生成失败的问题,提出无需训练的WarpHammer框架,通过引入3D生成先验的物体显式重建来补充缺失前景并遮挡不应可见的背景点,恢复外观和相机线索,并首次支持融合外部辅助物体视图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31679 2026-07-01 cs.GR cs.CV 新提交 62%

Practical High-Fidelity Novel-View Synthesis of Mounted Lepidoptera

实用高保真新视角合成:鳞翅目针插标本

Kristof Overdulve, Lode Jorissen, Nick Michiels

机构 * Digital Future Lab, Flanders Make, Hasselt University(数字未来实验室,弗兰德斯制造,哈瑟尔特大学)

专题命中 新视角合成 :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 针对鳞翅目针插标本微小脆弱、景深有限及腹面拍摄困难的问题,提出结合手持焦点堆叠、非接触第一表面镜系统和无分割镜面感知3D高斯泼溅的端到端管线,实现高保真3D重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31585 2026-07-01 cs.CV cs.AI 新提交 57%

DPPE: Rethinking Camera-Based Positional Encoding for Scaling Multi-View Transformers

DPPE:重新思考基于相机的可缩放多视图Transformer的位置编码

Shun Kenney, Teppei Suzuki

机构 * Keio University(庆应义塾大学) SB Intuitions

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 针对多视图Transformer中基于相机参数的位置编码导致训练后期性能停滞的问题,提出解耦位姿位置编码(DPPE),将旋转和平移显式分离,实现稳定长训练并提升外推泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18747 2026-07-01 cs.CV 版本更新 57%

URoPE: Universal Relative Position Embedding across Geometric Spaces

URoPE: 在几何空间中实现通用的相对位置嵌入

Yichen Xie, Depu Meng, Chensheng Peng, Yihan Hu, Quentin Herau, Masayoshi Tomizuka, Wei Zhan

机构 * Applied Intuition(应用直觉) University of California, Berkeley(加州大学伯克利分校)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 URoPE扩展了RoPE,使模型能在不同视角或维度的几何空间中处理位置信息,适用于多任务如视图合成、3D检测等,提升模型在几何推理中的表现。

Comments Accepted by ECCV 2026. Code is available: https://urope-pe.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 3D生成 1 篇

2606.30429 2026-07-01 cs.LG 版本更新 71%

Arko-T: A Foundation Model for Text-to-Structured 3D Generation

Arko-T: 面向文本到结构化3D生成的基础模型

Liang Wang, Zhaoyang Xi, Zekai Xiang, Heng Meng, Qishan Zhang, Pingyi Zhou, Jin Liu, Litao Chen

机构 * Spatial Design Intelligence Lab, BitInf Ltd.(BitInf有限公司空间设计智能实验室) School of Computer Science, Wuhan University(武汉大学计算机学院) College of Computer and Information Engineering, Nanjing Tech University(南京工业大学计算机与信息工程学院)

专题命中 3D生成 :3D generation(title)

AI总结 提出4B参数文本到设计模型Arko-T,通过设计状态对齐实现从自然语言到可编辑参数化CAD程序的生成,在12项指标中8项最优,成本仅为前沿模型的十分之一。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 空间理解 1 篇

2606.31688 2026-07-01 cs.CV 新提交 57%

Semantic Occupancy Prediction with Dual Range-Voxel Representation

基于双范围-体素表示的语义占用预测

Sitao Chen, Zhuangwei Zhuang, Hui Luo, Lizhao Liu, Qingyao Wu, Mingkui Tan

机构 * School of Software Engineering, South China University of Technology(华南理工大学软件学院) State Key Laboratory of Optical Field Manipulation Science and Technology, Institute of Optics and Electronics, CAS(中国科学院光电技术研究所光学场操控科学与技术国家重点实验室)

专题命中 空间理解 :point cloud(abstract);分类 cs.CV

AI总结 提出双范围-体素表示(DRVR),利用单扫描点云的范围视图和体素视图几何信息进行3D语义占用预测,避免多扫描带来的计算和鲁棒性问题,在nuScenes-Occupancy上mIoU提升5.4%,速度提升2.1倍。

详情

展开后加载摘要…

URL PDF HTML 收藏