arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-09 至 2026-06-09 共收录 9 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2604.22482 2026-06-09 cs.CV cs.GR 版本更新 84%

Holo360D: A Large-Scale Real-World Dataset with Continuous Trajectories for Advancing Panoramic 3D Reconstruction and Beyond

Holo360D: 一个大规模真实世界数据集,具有连续轨迹,用于推进全景3D重建及更广泛领域

Jing Ou, Zidong Cao, Yinrui Ren, Zhuoxiao Li, Jinjing Zhu, Tongyan Hua, Shuai Zhang, Hui Xiong, Wufan Zhao

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) South China Normal University(华南师范大学)

专题命中 三维重建 :3D reconstruction(title,abstract);point cloud(abstract);分类 cs.CV、cs.GR

AI总结 本文提出Holo360D数据集,包含109495张全景图像及注册点云、网格和对齐相机姿态,通过连续轨迹和高完整性深度图提升全景3D重建性能,建立新基准并提供有效微调策略。

Comments Datasets Link: https://github.com/Jou719/Holo360D

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01171 2026-06-09 cs.CV cs.LG 版本更新 57%

CADFit: Precise Mesh-to-CAD Program Generation with Hybrid Optimization

CADFit:基于混合优化的精确网格到CAD程序生成

Ghadi Nehme, Eamon Whalen, Faez Ahmed

机构 * Department of Mechanical Engineering, Massachusetts Institute of Technology, Cambridge, MA 02139, USA(麻省理工学院机械工程系)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 提出CADFit框架,通过基于几何反馈的增量拟合和验证参数化操作,从网格中恢复复杂可编辑的CAD构造序列,在多个基准上优于现有方法,并显著降低无效比率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 1 篇

2606.07118 2026-06-09 cs.RO 版本更新 84%

QuadVerse: An Integrated Framework Aligning Visual-Physical Reality for Quadruped Simulation

QuadVerse:一种对齐视觉-物理现实用于四足仿真的集成框架

Yuxiang Chen, Yuanhao Wang, Ziheng Zhang, Meng Zhang, Yu Liu, Yufei Jia, Tiancai Wang, Erjin Zhou, Jin Xie

机构 * Nanjing University(南京大学) BUPT(北京邮电大学) DEXMAL Tsinghua University(清华大学)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(abstract);分类 cs.RO

AI总结 提出QuadVerse框架,通过重建场景校准视觉、物理和致动器,利用3DGS和接触校准减少仿真到现实的差距,实现零样本视觉导航策略部署。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 5 篇

2605.01320 2026-06-09 cs.CV 版本更新 79%

PACE: Post-Causal Entropy Modeling for Learned LiDAR Point Cloud Compression

PACE:用于学习LiDAR点云压缩的后因果熵建模

Jiahao Zhu, Kang You, Dandan Ding, Zhan Ma

机构 * School of Information Science and Technology, Hangzhou Normal University, Hangzhou, China.(信息科学与技术学院,杭州师范大学,杭州,中国) School of Electronic Science and Engineering, Nanjing University, Nanjing, China(电子科学与工程学院,南京大学,南京,中国)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 PACE通过非因果骨干网络和轻量级预测器提升LiDAR点云压缩效率,实现90%以上的解码延迟降低和BD-BR节省。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16512 2026-06-09 cs.CV cs.CG cs.GR cs.LG cs.NA math.NA 版本更新 62%

Medial Axis Aware Learning of Signed Distance Functions

面向中轴线的符号距离函数学习

Samuel Weidemaier, Christoph Norden-Smoch, Martin Rumpf

机构 * Institute for Numerical Simulation, University of Bonn(数值模拟研究所,波恩大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.GR

AI总结 本文提出一种新的变分方法,用于计算高精度的全局符号距离函数,通过高阶变分公式考虑梯度的跳跃集,以提高计算精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18020 2026-06-09 cs.CV cs.RO 版本更新 62%

UAOR: Uncertainty-aware Observation Reinjection for Vision-Language-Action Models

UAOR: 面向视觉-语言-动作模型的不确定性感知观测重注入

Jiabing Yang, Yixiang Chen, Yuan Xu, Peiyan Li, Zichen Wen, Bowen Fang, Tao Yu, Xiangnan Wu, Qisen Ma, Kai Wang, Ziheng He, Yingda Li, Zhengbo Zhang, Jing Liu, Nianfeng Liu, Yan Huang, Liang Wang

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别新技术实验室) Shanghai Jiao Tong University(上海交通大学) FiveAges(五代)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出UAOR模块,通过动作熵检测不确定性,在语言模型高不确定层重注入观测信息,无需额外训练或数据,提升VLA模型在仿真和真实任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07318 2026-06-09 cs.CV cs.AR eess.IV 版本更新 57%

Embedded Graph Convolutional Networks for Real-Time Event Data Processing on SoC FPGAs

嵌入式图卷积网络用于SoC FPGA上的实时事件数据处理

Kamil Jeziorek, Piotr Wzorek, Krzysztof Blachut, Andrea Pinna, Tomasz Kryjak

机构 * University of Warsaw(华沙大学) Politechnika Warszawska(华沙理工大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出一种针对事件相机的硬件感知图卷积网络EFGCN,在SoC FPGA上实现实时处理,模型大小相比AEGNN降低100倍,精度仅下降2.9%。

Comments Submitted to the IEEE Transactions on Very Large Scale Integration Systems. This manuscript was first submitted for publication on March 31, 2024. It has since been revised three times: on 22 Mau 2024, 10 June 2024 and 19 June 2025 (major update)

Journal ref Journal of Systems Architecture, Volume 177, August 2026, 103850

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10888 2026-06-09 stat.ML math.MG 版本更新 50%

Conic Formulations of Transport Metrics for Unbalanced Measure Networks and Hypernetworks

非平衡测度网络与超网络的运输度量锥形公式

Mary Chriselda Antony Oliver, Emmanuel Hartman, Tom Needham

专题命中 点云 :point cloud(abstract)

AI总结 提出基于半耦合的锥形Gromov-Wasserstein距离新公式,扩展至网络与超网络比较,证明缩放、收敛和鲁棒性性质,并设计块坐标上升算法。

Comments 41 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 空间理解 1 篇

2603.14342 2026-06-09 cs.CV cs.AI 版本更新 57%

AgroOmni: A Large-Scale Multi-view Agricultural Dataset for Cross-Scale Multimodal Reasoning

AgroOmni:一个大规模多视角农业数据集用于跨尺度多模态推理

Jiarui Zhang, Junqi Hu, Zurong Mai, Yang Liu, Yuhang Chen, Shuohong Lou, Henglian Huang, Hong Cheng, Lingyuan Zhao, Jianxi Huang, Yutong Lu, Haohuan Fu, Juepeng Zheng

机构 * Sun Yat-sen University(中山大学) Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) HuanTian Wisdom Technology Co., Ltd.(慧天智慧科技有限公司) China Agricultural University(中国农业大学) Southwest Jiaotong University(西南交通大学) National Supercomputing Center in Shenzhen(深圳国家超算中心) The Chinese University of Hong Kong(香港中文大学)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV

AI总结 本文提出AgroOmni数据集,通过288K视觉问答对覆盖56个专业任务类别,解决多视角跨尺度农业多模态推理中的尺度偏差问题,提出AgroNVILA模型在AgroMind基准上达到62.32%的SOTA成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏