arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-08-18 至 2026-08-18 共收录 15 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4 篇

2604.20784 2026-08-18 cs.CV 版本更新 83%

GeoRect4D: Geometry-Compatible Generative Rectification for Dynamic Sparse-View 3D Reconstruction

GeoRect4D:几何兼容的生成性矩形化用于动态稀疏视角3D重建

Zhenlong Wu, Zihan Zheng, Xuanxuan Wang, Lei Huang, Hongwei Hu, Xiaoyun Zhang, Qiang Hu, Wenjun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 三维重建 :3D reconstruction(title);3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出GeoRect4D框架,通过闭环优化结合显式3D一致性与生成性细化,解决动态稀疏视角3D重建中的几何崩溃和漂移问题,提升重建精度与时间一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26182 2026-08-18 cs.AI cs.GR 版本更新 57%

BrickAnything: Geometry-Conditioned Buildable Brick Generation with Structure-Aware Tokenization

BrickAnything: 基于几何条件的可构建砖块生成与结构感知标记化

Zhengyang Ni, Feng Yan, Yu Guo, Fei Wang

机构 * Xi’an Jiaotong University(西安交通大学) State Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家重点实验室) Institute of Artificial Intelligence and Robotics(人工智能与机器人研究院)

专题命中 三维重建 :point cloud(abstract);分类 cs.GR

AI总结 提出BrickAnything,一个基于几何条件的自回归框架,通过结构感知树标记化生成满足装配约束和结构稳定性的砖块结构。

Comments Revised version with updated Code: this https URL (https://github.com/xjtunzy/BrickAnything)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18005 2026-08-18 cs.CV 版本更新 57%

UrbanWorld2.0: A Multimodal Agentic Framework for Reality-Aligned 3D World Generation at City-Scale

RAISECity: 一种用于城市级现实对齐3D世界生成的多模态代理框架

Shengyuan Wang, Zhiheng Zheng, Yu Shang, Lixuan He, Yangcheng Yu, Fan Hangyu, Jie Feng, Qingmin Liao, Yong Li

机构 * College of AI, Tsinghua University(人工智能学院,清华大学) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系,北京研究院,清华大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 RAISECity通过多模态代理框架实现城市级3D世界生成,提升现实对齐、精度和性能,适用于沉浸媒体和具身智能应用。

Comments Accepted by ACM MM 2026, the code is available at: this https URL (https://github.com/tsinghua-fib-lab/UrbanWorld2.0)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19259 2026-08-18 astro-ph.GA astro-ph.IM 版本更新 50%

Cloud2to3: Three-dimensional reconstruction via spherization

Cloud2to3:基于球化的三维重建方法

Xunchuan Liu, Pak-Shing Li

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 针对二维转三维结构重建的视线简并难题,提出Cloud2to3框架,推广逆阿贝尔变换与AVIATOR算法,经三种基准策略测试,可稳健保留密度统计特性,定性呈现纤维连接等形态特征。

Comments revised version

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2603.27151 2026-08-18 cs.GR cs.CV 版本更新 62%

DiffSoup: Direct Differentiable Rasterization of Triangle Soup for Extreme Radiance Field Simplification

DiffSoup:三角汤的直接可微化着色以实现极端辐射场简化

Kenji Tojo, Bernd Bickel, Nobuyuki Umetani

机构 * The University of Tokyo(东京大学) ETH Zürich(苏黎世联邦理工学院)

专题命中 NeRF :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 本文提出DiffSoup,一种利用少量三角形和神经纹理的辐射场表示,通过随机遮罩实现直接可微的二进制不透明度,从而在无需平滑着色的情况下实现高效的实时渲染。

Comments v2: Corrected all parameter counts in the "# Params" column of Table 3, which were incorrectly reported as 10 times smaller. This correction does not affect the discussion or conclusions drawn from the comparison

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 4 篇

2508.05950 2026-08-18 cs.CV cs.AI 版本更新 89%

Reprojection-Guided 3D Gaussian Splatting Diffusion for Weakly Supervised Single-Image Normal Estimation

CLONE: 基于3DGS的闭环可微优化框架用于单图像法线估计

Yanxing Liang, Yinghui Wang, Wei Li, Tao Yan, Jiaxing Shen

机构 * School of Artificial Intelligence and Computer Science, Jiangnan University, Wuxi, China(江南大学人工智能与计算机科学学院,中国无锡) School of Data Science, Lingnan University, Hong Kong, China(岭南大学数据科学学院,中国香港)

专题命中 Gaussian Splatting :3DGS(title_cn,abstract);Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 提出CLONE框架,通过3D高斯泼溅参数化场景并利用协方差特征分解得到连续可微法线,结合可微光照模型和一步确定性扩散精化网络,在统一重投影目标下联合优化,实现无需真值法线监督的几何一致性单图像法线估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09074 2026-08-18 cs.CV 版本更新 85%

REFINE: Super-efficient 3D Gaussian Splatting Pruning via Rendering-Free Primitive Importance

REFINE: 通过无渲染的基元重要性实现超高效的3D高斯泼溅剪枝

Zhang Chen, Shuai Wan, Mengting Yu, Fuzheng Yang, Junhui Hou

机构 * Northwestern Polytechnical University(西北工业大学) Xidian University(西安电子科技大学) City University of Hong Kong(香港城市大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 提出REFINE框架,利用无渲染的基元重要性度量(基于解析近似的Hessian场)实现3D高斯泼溅的高效剪枝,在保持渲染质量的同时将剪枝计算复杂度降低3000倍。

Comments We corrected the results of LightGaussian and MesonGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16910 2026-08-18 cs.CV cs.RO 版本更新 81%

LAGS: Low-Altitude Gaussian Splatting with Groupwise Heterogeneous Graph Learning

LAGS:低空高斯点云与群体异构图学习

Yikun Wang, Yujie Wan, Wei Zuo, Shuai Wang, Yik-Chung Wu, Chengzhong Xu, Huseyin Arslan

机构 * The University of Hong Kong(香港大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) Southern University of Science and Technology(南方科技大学) State Key Laboratory of IOTSC, University of Macau(澳门大学物联网科学国家重点实验室) College of Engineering, Istanbul Medipol University(伊斯坦布尔Medipol大学工程学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV、cs.RO

AI总结 LAGS通过聚合分布式无人机的航拍图像实现3D场景重建,但现有低空资源分配方案因未考虑视角差异导致效率低下。本文提出GW-HGNN,通过图学习平衡数据保真度与传输成本,实验表明其在关键渲染指标上优于现有方法,并显著降低计算延迟。

Comments 8 pages, 12 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05896 2026-08-18 cs.AI cs.IT 版本更新 78%

GSBF: Gaussian Splatting for Environment-Aware Beamforming

GSBF:面向环境感知波束成形的高斯溅射

Yijie Bian, Wei Guo, Zixin Wang, Shenghui Song, Jun Zhang, Khaled B. Letaief

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract)

AI总结 该研究针对传统波束成形依赖瞬时CSI导致开销高的问题,提出GSBF方法,通过3D高斯表示刻画环境,利用Bi-SG核与电磁光栅化合成波束,仿真显示其性能优于EBA且延迟更低。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 4 篇

2602.13185 2026-08-18 cs.CV cs.GR 版本更新 62%

FlexAM: Flexible Appearance-Motion Decomposition for Versatile Video Generation Control

FlexAM: 一种灵活的外观-运动分解方法用于多功能视频生成控制

Mingzhi Sheng, Zekai Gu, Peng Li, Cheng Lin, Hao-Xiang Guo, Ying-Cong Chen, Yuan Liu

机构 * HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学) MUST(澳门大学) Tsinghua University(清华大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.GR

AI总结 FlexAM通过引入新型3D控制信号,实现外观与运动的解耦,提升视频生成任务的灵活性和生成质量。

Comments Codes: this https URL (https://github.com/IGL-HKUST/FlexAM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24476 2026-08-18 eess.SP 版本更新 50%

WiWorld-RealData: A Real-World Multi-Modal Dataset for 6G Wireless World Models

WiWorld-RealData:用于6G无线世界模型的真实世界多模态数据集

Yinyin Jiao, Huixin Xu, Jianhua Zhang, Yuelong Qiu, Jingjing Wang, Shaoyi Liu, Yuxiang Zhang, Li Yu, Xuebin Sun, Guangyi Liu

专题命中 点云 :point cloud(abstract)

AI总结 提出WiWorld-RealData数据集,包含3.7 GHz和6.775 GHz的信道冲激响应、多视角图像、全景图像、LiDAR点云、毫米波雷达记录和GNSS轨迹,支持环境辅助的信道预测,路径损耗预测MAE为2.02 dB。

Comments 6 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00187 2026-08-18 physics.ins-det hep-ex hep-ph physics.comp-ph 版本更新 50%

Cross-Geometry Transfer Learning in Fast Electromagnetic Shower Simulation

快速电磁 shower 模拟中的跨几何迁移学习

Frank Gaede, Gregor Kasieczka, Lorenzo Valente

专题命中 点云 :point cloud(abstract)

AI总结 本文提出了一种迁移学习框架,用于快速电磁 shower 模拟,通过点云表示和预训练实现跨几何结构的高效适应,显著提升了模拟精度。

Comments Published version. 38 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01467 2026-08-18 cs.LG cs.DM 版本更新 50%

Feature-Aware (Hyper)graph Generation via Next-Scale Prediction

特征感知的(超)图生成:基于下一尺度预测

Dorian Gailhard, Enzo Tartaglione, Lirida Naviner, Jhony H. Giraldo

专题命中 点云 :point cloud(abstract)

AI总结 提出FAHNES框架,通过层次化下一尺度预测联合生成图/超图的拓扑和特征,实现大规模带特征图/超图的高效生成。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 新视角合成 1 篇

2606.20531 2026-08-18 cs.CV 版本更新 90%

VisDom: Sparse Novel View Synthesis with Visible Domain Constraint

VisDom: 具有可见域约束的稀疏新视角合成

Mariia Gladkova, Tarun Yenamandra, Edmond Boyer, Robert Maier, Tony Tung, Daniel Cremers

机构 * TU Munich(慕尼黑工业大学) MCML(慕尼黑机器学习中心)

专题命中 新视角合成 :NeRF(summary_cn,abstract);novel view synthesis(title,abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出VisDom,一种无学习的几何约束,通过最小多视角可见性要求增强视觉外壳重建,作为稀疏新视角合成中的空间先验,集成到NeRF和GS管线中,从四张输入图像实现高质量重建。

Comments Accepted to GCPR 2026 (Oral). Project page and code: this https URL (https://tarun738.github.io/visdom/)

详情

展开后加载摘要…

URL PDF HTML 收藏

6. SLAM与定位 1 篇

2608.01509 2026-08-18 cs.CV 版本更新 57%

Rolling Shutter Camera Self-Calibration

卷帘快门相机自校准

Yongcong Zhang, Navid Rabbani, Bangyan Liao, Chengbo Wang, Yizhen Lao, Adrien Bartoli

机构 * CHU Clermont-Ferrand(克莱蒙费朗大学中心医院) SURGAR, Surgical Augmented Reality(外科增强现实研究组) School of Engineering, Westlake University(西湖大学工程学院) School of Design, Hunan University(湖南大学设计学院)

专题命中 SLAM与定位 :3D vision(abstract);分类 cs.CV

AI总结 本文提出了首个无需校准靶标的卷帘快门相机自校准方法,通过结合两种互补成像模型构建统一双投影模型,经仿真与真实数据实验验证了方法的准确性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏