arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-22 至 2026-07-22 共收录 12 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2607.18630 2026-07-22 cs.CV 新提交 79%

Seeing Before Generating: Object Perception Enhances Single-View 3D Reconstruction

生成前的观察:物体感知增强单视图3D重建

Y Huynh, Duc Thanh Nguyen, Mohamed Abdelrazek

机构 * Deakin University(迪肯大学) Applied Artificial Intelligence Initiative(应用人工智能倡议组织) School of Information Technology(信息技术学院)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 研究单视图3D物体重建问题,提出利用预训练感知模型提取的感知信号驱动重建的方法,该方法与模型无关且可即插即用,实验验证其能显著提升重建效果,为3D重建提供新思路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19228 2026-07-22 cs.CV 新提交 57%

IGGT4D: Streaming 4D Instance-Grounded Geometry Transformer

IGGT4D:流式4D实例关联几何变换器

Zhengyu Zou, Hao Li, Kuixuan Jiao, Liu Liu, Tingyang Xiao, Xiaolin Zhou, Fangzhou Hong, Zhizhong Su, Dingwen Zhang, Ziwei Liu

机构 * Horizon Robotics(地平线机器人公司) S-Lab, Nanyang Technological University(南洋理工大学S-Lab) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对现实世界空间智能中视频流场景理解问题,提出IGGT4D流式实例关联几何变换器,通过因果时空建模更新统一表示,还构建数据集。实验证明其在长动态序列在线推理上优于现有基线。

Comments Project Page: https://iggt4d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 4 篇

2607.18539 2026-07-22 cs.CV 新提交 84%

AniGS: Bridging Rendering and Diffusion Prior for 3D Scene Animation

AniGS:弥合3D场景动画的渲染与扩散先验

Yen-Chi Cheng, Chen Gao, Chuhan Chen, Tuotuo Li, Rajvi Shah, Ayush Saraf, Changil Kim, Liangyan Gui, Alexander Schwing, Johannes Kopf, Hung-Yu Tseng

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Waymo(Waymo公司) Carnegie Mellon University(卡内基梅隆大学) Meta

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 AniGS旨在为3DGS重建的大型场景添加动画,用规范3DGS表示场景,借时间条件变形场建模运动,利用预训练视频扩散模型及迭代更新策略,防止静态区域运动伪影,实验证明该方法能产生自然动态和高质量新视图视频。

Comments Preprint. Project page: https://yccyenchicheng.github.io/AniGS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18801 2026-07-22 cs.CV 新提交 83%

ZeroSplat: Generalized Referring Segmentation in 3D Gaussian Splatting

ZeroSplat:3D高斯点云渲染中的广义指代分割

Jiayu Ding, Meilu Song, Xiaoyi Zhang, Hongbo Jin, Yichen Jin, Xiangtian Si

机构 * Peking University(北京大学) North China Electric Power University(华北电力大学) China University of Geosciences(中国地质大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 针对现有指代3D高斯点云渲染方法局限,提出ZeroSplat框架,通过多视图几何约束将2D视觉语言模型先验提升至3D空间,无需额外特征存储,在广义和单目标场景中显著优于现有方法,且效率高。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18466 2026-07-22 cs.CV cs.GR 新提交 62%

ECoNGS: Efficient Compressive Neural Gaussian Splats for Volume Visualization

ECoNGS:用于体数据可视化的高效压缩神经高斯点云

Kaiyuan Tang, Chaoli Wang

机构 * University of Notre Dame(圣母大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 研究针对大型数据集体数据可视化,提出ECoNGS框架,用轻量级神经网络从显式锚点预测隐式高斯点云,结合联合学习策略、神经熵模型压缩及特定初始化策略,相比iVR-GS在多方面性能更优。

Comments To be published in Proceedings of IEEE VIS 2026, IEEE Transactions on Visualization and Computer Graphics

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19100 2026-07-22 cs.CV 新提交 57%

FlexiAvatar: Unified 3D Gaussian Human Avatars Under Arbitrary Body Visibility

FlexiAvatar:任意身体可见性下的统一3D高斯人体头像

Yihalem Yimolal Tiruneh, Muhammad Salman Ali, Uyoung Jeong, Muneeb A. Khan, MD Khalequzzaman Chowdhury Sayem, Allanur Bayramgeldiyev, Binod Bhattarai, Seungryul Baek

机构 * UNIST(韩国蔚山科学技术院) University of Aberdeen(阿伯丁大学) University College London(伦敦大学学院) Fogsphere(雾球公司)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究从单目视频重建3D人体头像问题,提出FlexiAvatar框架,结合遮挡鲁棒跟踪与特定部分残差细化捕捉细节,用扩散方法处理不可见区域,实验表明其重建质量高,还能减少运行时和内存开销。

Comments Accepted in ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 2 篇

2607.19171 2026-07-22 cs.CV 新提交 74%

Point Ladder Tuning: Parameter-Efficient Hierarchical Adaptation for 3D Point Cloud Understanding

点阶梯调优:用于3D点云理解的参数高效分层适配

Junlin Chang, Longhao Zou, Rui Li

机构 * Beihang University(北京航空航天大学) Pengcheng Laboratory(鹏城实验室)

专题命中 点云 :point cloud(title);分类 cs.CV

AI总结 研究针对3D点云理解中微调预训练主干参数效率低的问题,提出点阶梯调优框架PLT,通过构建分层网络、融合局部与全局特征、生成动态提示等进行参数高效分层适配,实验表明其以极少参数达最优性能。

Comments Accepted to ECCV 2026. Code: https://github.com/JunLinChang/ECCV2026-PLT

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18578 2026-07-22 cs.RO eess.SP 新提交 57%

Two-Stage Extrinsic Calibration of a Static Line-Scanning Lidar with a Rotary Platform

基于旋转平台的静态线扫描激光雷达的两阶段外部校准

Vikram Shree, Hike Danakian, Long Nguyen, Rajanish Gokidi, Patrick Nercessian

机构 * SiLC Technologies(SiLC技术公司)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 研究基于旋转平台的静态线扫描激光雷达校准问题,探索自动方法静态和动态估计旋转轴变换,通过真实数据集验证算法并研究其收敛特性。

Comments 8 pages, 13 figures. Manuscript accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 3D生成 1 篇

2607.19120 2026-07-22 cs.CV 新提交 57%

Latent Riemannian Flow Matching for Geometry-Grounded 3D Foundation Models

用于几何基础3D基础模型的潜在黎曼流匹配

Lisa Weijler, Irene Ballester, Guofeng Mei, Tolga Birdal, Pedro Hermosilla

机构 * TU Wien(维也纳工业大学) Fondazione Bruno Kessler(布鲁诺·凯斯勒基金会) Imperial College London(伦敦帝国理工学院)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV

AI总结 研究如何弥合几何基础模型与3D场景生成模型的范式差异,通过在VGGT潜在空间进行黎曼流匹配,利用其3D先验,不依赖明确下游表示,在多个数据集上取得良好性能,确立该方法为3D生成的可行范式。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. SLAM与定位 3 篇

2607.19306 2026-07-22 cs.RO cs.AI cs.CV cs.SY eess.SY 新提交 62%

From Distances to Trajectories: Real-Time Signed Distance Function Mapping and Distance-Accelerated Motion Planning for UAVs

从距离到轨迹:无人机的实时带符号距离函数映射与距离加速运动规划

Jason Stanley, Zhirui Dai, Qihao Qian, Tzu-Chin Ho, Tianxing Fan, Siddharth Saha, Christopher Barngrover, Ki Myung Brian Lee, Nikolay Atanasov

机构 * UC San Diego(加州大学圣地亚哥分校) Shield AI(护盾人工智能公司)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 研究针对无人机在杂乱环境中的自主飞行,提出围绕带符号距离函数协同设计映射与规划阶段。开发OREN重建SDF,Bubble$^\star$基于距离信息规划,减少碰撞检查。集成方法在四旋翼飞行器上实时导航,提升SDF估计并快速找到长轨迹。

Comments 25 pages, 10 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18875 2026-07-22 cs.CV 新提交 57%

Wave2Body: Rethinking mmWave Human Pose Estimation as Radar-to-Body Token Translation

Wave2Body:将毫米波人体姿态估计重新思考为雷达到身体的令牌转换

Bo Liang, Chen Gong, Wei Gao, Chenren Xu

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) University of Pittsburgh(匹兹堡大学) Key Laboratory of High Confidence Software Technologies, Ministry of Education (PKU)(教育部高可信软件技术重点实验室(北京大学))

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 针对毫米波雷达人体姿态估计问题,提出Wave2Body框架,通过自监督毫米波令牌器等解耦学习目标,在M4Human和mmBody实验中展现出比以往方法更强的跨域泛化能力及更低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18779 2026-07-22 cs.CV 新提交 57%

CGMap: A Geospatially Aware Deep Learning Framework for Crop Gap Mapping Using UAV

CGMap:一种使用无人机进行作物间隙映射的地理空间感知深度学习框架

Karan Sharma, Rajiv Ranjan, Dinesh Kumar, Shashank Tamaskar

机构 * Plaksha University(普拉卡沙大学)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 针对印度作物发芽监测易出错的问题,提出基于深度学习的CGMap框架,利用YOLOV8架构和无人机图像,结合最小生成树技术,精确计算甘蔗发芽情况,输出地理空间发芽图,助力提高产量和资源合理分配。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏