arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-03-04 至 2026-03-04 共收录 4 信号源:cs.CV, cs.GR, cs.RO

1. 空间理解 4 篇

2603.03002 2026-03-04 cs.AI 71%

SpatialText: A Pure-Text Cognitive Benchmark for Spatial Understanding in Large Language Models

SpatialText: 一种纯文本的认知基准,用于大型语言模型中的空间理解

Peiyao Jiang, Zequn Qin, Xi Li

机构 * Zhejiang University(浙江大学) School of Software Technology, Zhejiang University(软件技术学院,浙江大学)

专题命中 空间理解 :spatial understanding(title)

AI总结 SpatialText通过双源方法为大型语言模型提供纯文本空间认知基准,揭示其在空间推理中的系统性缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02609 2026-03-04 cs.CV cs.RO 62%

VLMFusionOcc3D: VLM Assisted Multi-Modal 3D Semantic Occupancy Prediction

VLMFusionOcc3D: 基于VLM的多模态3D语义占位预测

A. Enes Doruk, Hasan F. Ates

机构 * Department of Artificial Intelligence and Data Engineering, Ozyegin University(人工智能与数据工程系,奥克辛大学)

专题命中 空间理解 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 VLMFusionOcc3D通过融合视觉语言模型的语义先验,提升多模态3D语义占位预测的鲁棒性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02724 2026-03-04 cs.SD cs.LG 50%

Single Microphone Own Voice Detection based on Simulated Transfer Functions for Hearing Aids

基于模拟传输函数的单麦克风自身语音检测

Mathuranathan Mayuravaani, W. Bastiaan Kleijn, Andrew Lensen, Charlotte Sørensen

专题命中 空间理解 :spatial understanding(abstract)

AI总结 本文提出基于模拟传输函数的单麦克风自身语音检测方法,通过数据增强和层次化微调提升模型泛化能力,实现高准确率的OVD应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02498 2026-03-04 cs.HC 50%

Improving Low-Vision Chart Accessibility via On-Cursor Visual Context

通过光标视觉上下文提高低视力图表的可访问性

Yotam Sechayk, Hennes Rave, Max Rädler, Mark Colley, Zhongyi Zhou, Ariel Shamir, Takeo Igarashi

专题命中 空间理解 :spatial understanding(abstract)

AI总结 本文提出两种基于指针的交互方法,通过提供视觉上下文提高低视力者访问图表的能力,同时平衡视觉负荷。

Comments CHI '26, Barcelona, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏