arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-16 至 2026-06-16 共收录 33 信号源:cs.CV, cs.GR, cs.RO

1. 3D生成 1 篇

2605.19876 2026-06-16 cs.CV 版本更新 79%

Structural Energy Guidance for View-Consistent Text-to-3D Generation

基于结构能量的视图一致文本到3D生成

Qing Zhang, Jinguang Tong, Jing Zhang, Jie Hong, Xuesong Li

机构 * Australian National University(澳大利亚国立大学) CSIRO(澳大利亚国家科学委员会) The University of Hong Kong(香港大学)

专题命中 3D生成 :3D generation(title,abstract);分类 cs.CV

AI总结 本文针对基于扩散模型的文本到3D生成中视图不一致问题,提出无需训练的SEGS框架,通过在U-Net特征的PCA子空间中构建结构能量并注入去噪过程,提升多视图一致性,实验表明有效降低Janus率并提升视图一致性评分。

Comments arXiv admin note: substantial text overlap with arXiv:2508.16917

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 空间理解 1 篇

2601.16207 2026-06-16 cs.RO 版本更新 57%

IVRA: Improving Visual-Token Relations for Robot Action Policy with Training-Free Hint-Based Guidance

IVRA: 通过无需训练的提示引导改善机器人动作策略的视觉-令牌关系

Jongwoo Park, Kanchana Ranasinghe, Jinhyeok Jang, Cristina Mata, Yoo Sung Jang, Michael S Ryoo

机构 * Stony Brook University(石溪大学) ETRI(电子技术研究院)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.RO

AI总结 提出IVRA方法,利用模型内置视觉编码器的亲和力提示,无需额外编码器或重训练,在推理时调整视觉-令牌交互以增强空间理解,在多种VLA架构和任务上提升操作成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. SLAM与定位 1 篇

2606.16881 2026-06-16 cs.RO 新提交 57%

SGM-SLAM: Scene Graph Matching for Data-Efficient Distributed SLAM

SGM-SLAM:面向数据高效的分布式SLAM的场景图匹配

Yewei Huang, Tixiao Shan, Abhinav Rajvanshi, Niluthpol Chowdhury Mithun, Yaxuan Li, Brendan Englot, Han-Pang Chiu

机构 * Dartmouth College(达特茅斯学院) SRI International(SRI国际) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.RO

AI总结 提出一种基于场景图匹配的分布式SLAM框架,仅使用对象标签和质心进行匹配,通过多步数据交换与优化实现高效通信,在室内外环境中验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏