arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-04-28 至 2026-04-28 共收录 31 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4 篇

2603.03269 2026-04-28 cs.CV cs.LG 57%

LoGeR: Long-Context Geometric Reconstruction with Hybrid Memory

LoGeR:长上下文几何重建与混合记忆

Junyi Zhang, Charles Herrmann, Junhwa Hur, Chen Sun, Ming-Hsuan Yang, Forrester Cole, Trevor Darrell, Deqing Sun

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 LoGeR通过混合记忆模块实现长序列的高精度3D重建,无需后优化,有效解决长视频中的上下文一致性问题,优于现有方法。

Comments Project page: https://LoGeR-project.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23574 2026-04-28 cs.CV 57%

PhysLayer: Language-Guided Layered Animation with Depth-Aware Physics

PhysLayer:基于语言的分层动画与深度感知物理

Tianyidan Xie, Zhentao Huang, Mingjie Wang, Xin Huang, Jun Zhou, Minglun Gong, Zili Yi

机构 * Nanjing University(南京大学) University of Guelph(圭尔夫大学) Zhejiang Sci-Tech University(浙江科技大学) Dalian Maritime University(大连海事大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 PhysLayer通过深度感知物理模拟和语言引导,实现静态图像的分层动画生成,提升了物理真实性和可控性,实验结果显示在多个指标上均有显著提升。

Comments Accepted to ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23537 2026-04-28 cs.GR 57%

Distance Field Rasterization for End-to-End Mesh Reconstruction

距离场光栅化用于端到端网格重建

Jinkai Cui, Kaiwen Song, Chumeng Niu, Juyong Zhang

专题命中 三维重建 :novel view synthesis(abstract);分类 cs.GR

AI总结 本文提出SDFRaster,结合光栅化效率与距离场,实现端到端网格重建,实验显示其在质量和存储成本上优于现有方法。

Comments Accepted to SIGGRAPH 2026, Project page: https://ustc3dv.github.io/SDFRaster/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22827 2026-04-28 cs.CV cs.LG 57%

DGHMesh: A Large-scale Dual-radar mmWave Dataset and Generalization-focused Benchmark for Human Mesh Reconstruction

DGHMesh: 一种大规模双雷达毫米波数据集及面向泛化能力的Human Mesh重建基准

Rongxiao Guo, Qingchao Chen

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出DGHMesh数据集和基准,用于评估毫米波Human Mesh重建方法的泛化能力,包含15名受试者8种动作的36万帧数据,采用多雷达融合框架mmPTM实现高精度重建。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 2 篇

2604.24187 2026-04-28 cs.CV 90%

Multivariate Gaussian NeRF for Wide Field-of-View Ultrasound Reconstruction

多变量高斯NeRF用于宽视野超声重建

Patris Valera, Magdalena Wysocki, Felix Duelmer, Mohammad Farid Azampour, Sebastian Herz, Stefan Wörz, Nassir Navab

机构 * Chair for Computer Aided Medical Procedures (CAMP), Technical University of Munich, Germany(计算机辅助医学程序系(CAMP),慕尼黑技术大学,德国) Munich Center for Machine Learning (MCML), Munich, Germany(慕尼黑机器学习中心,慕尼黑,德国) LUMA Vision, Beech Hill Road, Dublin, Ireland(LUMA视觉,Beech Hill Road,都柏林,爱尔兰)

专题命中 NeRF :NeRF(title,title_cn);分类 cs.CV

AI总结 本文提出基于多变量3D高斯的NeRF方法,用于宽视野超声重建,通过建模复杂声束几何减少伪影并提升反锯齿效果,验证了其在心脏超声中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23310 2026-04-28 cs.NI 50%

RadTwin: Generalizable Wireless Digital Twin for Dynamic Environments

RadTwin: 适用于动态环境的通用无线数字孪生

Yuru Zhang, Ming Zhao, Qiang Liu, Ahmed Alkhateeb, Abhishek K. Agrawal, Qi Qu

专题命中 NeRF :point cloud(abstract)

AI总结 本文提出RadTwin框架,通过场景几何条件化建模,实现动态环境下的无线数字孪生,实验显示其在SSIM和LPIPS指标上优于NeRF2,具备高泛化性和数据效率。

Comments This paper is accepted by IEEE ICCCN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 8 篇

2604.23803 2026-04-28 cs.CV 91%

Bringing a Personal Point of View: Evaluating Dynamic 3D Gaussian Splatting for Egocentric Scene Reconstruction

融入个人视角:评估动态3D高斯散射在眼动场景重建中的应用

Jan Warchocki, Xi Wang, Jonas Kulhanek, Jan van Gemert

机构 * Delft University of Technology(代尔夫特理工大学) TUM/MCML(慕尼黑工业大学/麦克斯·普朗克研究所) Czech Technical University in Prague(布拉格捷克技术大学)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);3D reconstruction(abstract);novel view synthesis(abstract)

AI总结 本文评估了动态单目3DGS模型在眼动和非眼动视频中的重建效果,发现眼动视角重建质量较低,原因在于模型更擅长静态内容而非动态场景。

Comments Accepted at the EgoVis Workshop at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13713 2026-04-28 cs.RO cs.CV 88%

SLAM&Render: A Benchmark for the Intersection Between Neural Rendering, Gaussian Splatting and SLAM

SLAM&Render: 一个用于神经渲染、高斯点绘和SLAM交叉领域的基准数据集

Samuel Cerezo, Gaetano Meli, Tomás Berriel Martins, Kirill Safronov, Javier Civera

机构 * Technology \& Innovation Center KUKA Deutschland GmbH Augsburg, Germany

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);NeRF(abstract,abstract_cn);novel view synthesis(abstract);分类 cs.CV、cs.RO

AI总结 本文提出SLAM&Render数据集,用于评估神经渲染和SLAM在多模态、多视角和光照条件下的交叉方法,包含40个序列的RGB-D图像、IMU数据和机器人运动数据,验证了该数据集在新兴研究领域的相关性。

Comments 9 pages, 8 figures, 7 tables. Submitted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05480 2026-04-28 cs.GR cs.CV cs.LG 86%

ODE-GS: Latent ODEs for Dynamic Scene Extrapolation with 3D Gaussian Splatting

ODE-GS:基于动态场景外推的隐式ODE与3D高斯点划法

Daniel Wang, Patrick Rim, Tian Tian, Dong Lao, Alex Wong, Ganesh Sundaramoorthi

机构 * Yale University(耶鲁大学) TU Delft(代尔夫特理工大学) Louisiana State University(路易斯安那州立大学) RTX(RTX公司)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);NeRF(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 ODE-GS结合隐式ODE与3D高斯点划法,通过连续时间隐式动态建模实现动态3D场景的未来外推,优于传统时间条件变形网络方法,提升外推性能19.8%。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23551 2026-04-28 cs.CV 85%

Spatiotemporal Degradation-Aware 3D Gaussian Splatting for Realistic Underwater Scene Reconstruction

时空降质感知的3D高斯点散布用于逼真水下场景重建

Shaohua Liu, Ning Gao, Zuoya Gu, Hongkun Dou, Yue Deng, Hongjue Li

机构 * School of Astronautics Beihang University Beijing China(航天学院 北航 北京 中国) School of Artificial Intelligence Beihang University Beijing China(人工智能学院 北航 北京 中国) Zhongguancun Academy Beijing China(中关村学院 北京 中国) Beihang University School of Astronautics Beijing China(北航 航天学院 北京 中国) Beihang University(北航) Zhongguancun Academy(中关村学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出MarineSTD-GS框架,通过建模时空降质实现逼真水下场景重建,引入内在高斯和降质高斯,结合时空降质建模模块,改进几何和外观估计,实验表明其在处理时空降质和合成新视角方面优于现有方法。

Comments 12 pages, 10 figures, 6 tables. Author version of the paper published in Proceedings of ACM Multimedia 2025

Journal ref Proceedings of the 33rd ACM International Conference on Multimedia (ACM MM 2025), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24053 2026-04-28 cs.CV 83%

Light 'em Up: Enabling Few-Shot Low-Light 3D Gaussian Splatting with Multi-Scale Explicit Retinex Illumination Decoupling

点亮它们:通过多尺度显式Retinex照明解耦实现少样本低光3D高斯点溅射

YuHao Yin, Zongji Wang, Yuanben Zhang, Biqing Li, Jiesong Bai, Junyi Liu

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空航天信息研究所) Key Laboratory of Target Cognition and Application Technology (TCAT)(目标认知与应用技术重点实验室) University of Chinese Academy of Sciences(中国科学院大学) School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院) Shanghai Jiao Tong University(上海交通大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出MERID-GS框架,通过多尺度显式Retinex照明解耦和3D高斯点溅射,实现低光环境下少样本高质量360度视图合成,同时提升跨场景泛化能力与视图一致性。

Comments 19 pages, 5 figures. Code available at https://github.com/YhuoyuH/MERID-GS

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17092 2026-04-28 cs.CV 83%

SPAGS: Sparse-View Articulated Object Reconstruction from Single State via Planar Gaussian Splatting

SPAGS:基于单一状态的稀疏视角关节物体重建(通过平面高斯溅射)

Di Wu, Liu Liu, Xueyu Yuan, Wenxiao Chen, Lijun Yue, Liuzhu Chen, Yiming Tang, Meng Wang

机构 * Hefei University of Technology(合肥工业大学) Tencent RoboticsX(腾讯机器人院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出一种无需多视角观测的关节物体重建方法,通过平面高斯溅射实现稀疏视角下的高精度重建,结合视觉-语言模型实现开放词汇部分分割与参数估计。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23675 2026-04-28 eess.IV cs.CV physics.med-ph 79%

GS-DOT: Gaussian splatting-based image reconstruction for diffuse optical tomography

基于高斯溅射的图像重建:用于扩散光学断层扫描

Jingjing Jiang

机构 * Computational Optical Imaging Group, Biomedical Optics Research Laboratory, Dept. of Neonatology, University Hospital Zurich(计算光学成像组、生物医学光学研究实验室、新生儿科部门、苏黎世大学医院) University of Zurich, Switzerland(苏黎世大学,瑞士)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 本文提出GS-DOT,一种基于高斯溅射的扩散光学断层扫描图像重建框架,通过优化高斯原始体实现吸收系数的稀疏表示,提高了噪声鲁棒性和内存效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07940 2026-04-28 cs.CV 77%

ISExplore:Informative Segment Selection for Efficient Personalized 3D Talking Face Generation

ISExplore:基于信息片段选择的高效个性化3D说话人脸生成

Rui-Qing Sun, Ang Li, Zhijing Wu, Tian Lan, Qianyu Lu, Xingshan Yao, Chen Xu, Xian-Ling Mao

机构 * Beijing Institute of Technology(北京理工大学)

专题命中 Gaussian Splatting :NeRF(abstract);Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 本文提出ISExplore方法,通过选择少量高信息量视频片段提升个性化3D说话人脸生成效率,减少5倍的处理时间并保持高质量生成。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 10 篇

2604.24586 2026-04-28 cs.CV 79%

Point-MF: One-step Point Cloud Generation from a Single Image via Mean Flows

点-流:通过均流实现单图像点云生成

Yuta Baba, Keiji Yanai

机构 * The University of Electro-Communications(电子通信大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出Point-MF框架,通过均流与辅助损失实现单图像点云重建,以单次网络调用完成高精度重建,提升效率与质量。

Comments 28 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24524 2026-04-28 cs.CV 79%

Point Cloud Registration for Fusion between SPECT MPI and CTA Images

点云配准用于SPECT MPI与CTA图像的融合

Ni Yao, Xiangyu Liu, Shaojie Tang, Danyang Sun, Chuang Han, Yanting Li, Jiaofen Nan, Chengyang Li, Fubao Zhu, Chen Zhao, Zhihui Xu, Weihua Zhou

机构 * School of Computer Science and Artificial Intelligence, Zhengzhou University of Light Industry(郑州轻工业大学计算机科学与人工智能学院) School of Automation, Xi’an University of Posts and Telecommunications(西安邮电大学自动化学院) Xi'an Key Laboratory of Advanced Control and Intelligent Process(西安先进控制与智能过程重点实验室) School of Information Management and Engineering, Shanghai University of Finance and Economics(上海财经大学信息管理与工程学院) Department of Computer Science, Kennesaw State University(肯尼斯州立大学计算机科学系) Department of Cardiology, The First Affiliated Hospital of Nanjing Medical University(南京医科大学第一附属医院心内科) Department of Applied Computing, Michigan Technological University(密歇根技术大学应用计算系) Center for Biocomputing and Digital Health, Institute of Computing and Cybersystems, and Health Research Institute, Michigan Technological University(密歇根技术大学生物计算与数字健康中心、计算与网络系统研究所及健康研究机构)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出一种融合SPECT MPI和CTA图像的配准框架,通过U-Net分割和多方法配准实现高精度心脏评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00995 2026-04-28 cs.CV 79%

S2AM3D: Scale-controllable Part Segmentation of 3D Point Clouds

S2AM3D: 可缩放部分的3D点云分割

Han Su, Tianyu Huang, Zichen Wan, Xiaohe Wu, Wangmeng Zuo

机构 * Harbin Institute of Technology(哈尔滨理工大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出S2AM3D,通过结合2D分割先验与3D一致监督,解决3D点云分割中数据稀缺和视图不一致的问题,实现对复杂结构的鲁棒分割。

Comments Accepted by CVPR 2026(Oral). Project page:https://sumuru789.github.io/S2AM3D-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22883 2026-04-28 cs.CV cs.AI 79%

NeuroAPS-Net: Neuro-Anatomically Aware Point Cloud Representation for Efficient Alzheimer's Disease Classification

NeuroAPS-Net:神经解剖意识点云表示用于高效阿尔茨海默病分类

Towhidul Islam, Mufti Mahmud

机构 * 1 ICS Department, King Fahd University of Petroleum \& Minerals, Dhahran, Saudi Arabia 2 SDAIA-KFUPM JRC for AI, King Fahd University of Petroleum \& Minerals, Dhahran, Saudi Arabia Machines, King Fahd University of Petroleum \& Minerals, Dhahran, Saudi Arabia

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出NeuroAPS-Net,通过解剖优先采样生成神经解剖标注的点云数据集,并采用轻量几何深度学习模型实现高效阿尔茨海默病分类。

Comments 6 pages, 3 figures, Accepted under IJCNN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12727 2026-04-28 cs.HC 78%

Virtual reality for large-scale laboratories based on colorized point clouds: design and pedagogical impact

基于彩色点云的大规模实验室虚拟现实:设计与教学影响

Lei Fan, Yuxin Li

专题命中 点云 :point cloud(title,abstract)

AI总结 本文提出一种基于WebVR的虚拟实验室,利用Unity和Potree实现高保真的点云可视化,提供沉浸式探索和交互功能,提升工程教育中的教学效果和学习体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13476 2026-04-28 cs.RO cs.CV 73%

RobotPan: A 360$^\circ$ Surround-View Robotic Vision System for Embodied Perception

RobotPan:一种用于具身感知的360度全景机器人视觉系统

Jiahao Ma, Qiang Zhang, Peiran Liu, Zeran Su, Pihai Sun, Gang Han, Wen Zhao, Wei Cui, Zhang Zhang, Zhiyuan Xu, Renjing Xu, Jian Tang, Miaomiao Liu, Yijie Guo

机构 * Tiangong 3.0 humanoid platform(天宫3.0人形平台)

专题命中 点云 :3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV、cs.RO

AI总结 本文提出RobotPan系统,通过六摄像头与LiDAR结合,实现360度全景视觉覆盖,采用统一球坐标表示和分层球体体素先验,实现高效实时渲染与重建,支持长时间序列处理,并发布多传感器数据集用于机器人导航与 manipulation。

Comments Project website: https://robotpan.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24487 2026-04-28 cs.RO 57%

Guiding Vector Field Generation via Score-based Diffusion Model

通过基于分数的扩散模型引导向量场生成

Zirui Chen, Shiliang Guo, Shiyu Zhao

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) WINDY Lab, Department of Artificial Intelligence, Westlake University(西湖大学人工智能系WINDY实验室)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出基于分数的引导向量场(SGVF),利用生成模型直接从数据分布构建向量场,解决传统方法在复杂路径中的不足,实验表明其在机器人导航中表现优异。

Comments 8 pages, 6 figrues, ICRA2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24370 2026-04-28 cs.CV 57%

Multispectral airborne laser scanning dataset for tree species classification: MS-ALS-SPECIES

多光谱航空激光扫描数据集用于树种分类:MS-ALS-SPECIES

Matti Hyyppä, Klaara Salolahti, Eric Hyyppä, Xiaowei Yu, Josef Taher, Leena Matikainen, Matti Lehtomäki, Paula Litkey, Teemu Hakala, Harri Kaartinen, Juha Hyyppä, Antero Kukko

机构 * Department of Remote Sensing and Photogrammetry(遥感与摄影测量系) Finnish Geospatial Research Institute(芬兰地理研究 institute) FGI The National Land Survey of Finland(芬兰国家土地测绘局)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出一个公开的多光谱ALS数据集,用于改进森林个体树级评估,通过高精度地面验证数据提升树种分类的多样性映射。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24311 2026-04-28 cs.CV 57%

BIMStruct3D: A Fully Automated Hybrid Learning Scan-to-BIM Pipeline with Integrated Topology Refinement

BIMStruct3D: 一种集成拓扑细化的全自动混合学习扫描到BIM流程

Mahdi Chamseddine, Fabian Kaufmann, Marius Schellen, Christian Glock, Didier Stricker, Jason Rambach

机构 * German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI)) RPTU Kaiserslautern-Landau(凯撒斯劳滕-兰道大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出BIMStruct3D流程,结合学习方法的语义分割与拓扑感知几何重建,生成符合IFC标准的BIM模型,并通过vIoU指标和德国医院数据集验证了其在建筑扫描到BIM任务中的有效性。

Comments Accepted in EC3 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23095 2026-04-28 cs.CV cs.ET 57%

INSIGHT: Indoor Scene Intelligence from Geometric-Semantic Hierarchy Transfer for Public~Safety

INSIGHT: 从几何-语义层次转移实现室内场景智能以提升公共安全

Alexander Nikitas Dimopoulos, Joseph Grasso, John Beltz

机构 * Public Safety Communications Research Division, National Institute of Standards and Technology(公共安全通信研究部,美国国家标准与技术研究院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出INSIGHT框架,通过注册的RGB-D数据将2D图像理解投影到3D空间,解决室内场景标注数据不足和小尺寸安全关键特征识别问题,生成兼容Pointcept的点云和符合ISO 19164的场景图。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 3D生成 3 篇

2504.02316 2026-04-28 cs.CV cs.AI 83%

ConsDreamer: Advancing Multi-View Consistency for Zero-Shot Text-to-3D Generation

ConsDreamer:推进多视图一致性以实现零样本文本到3D生成

Yuan Zhou, Shilong Jin, Litao Hua, Wanjun Lv, Haoran Duan, Jungong Han

机构 * School of Artificial Intelligence, Nanjing University of Information Science and Technology(南京信息工程大学人工智能学院) Department of Automation, Tsinghua University(清华大学自动化系) Lenovo(联想)

专题命中 3D生成 :3D generation(title,abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 ConsDreamer通过消除视图偏差和几何一致性约束,解决多面Janus问题,提升零样本文本到3D生成的多视图一致性。

Comments Accepted by IEEE Transactions on Image Processing, Code is available at: https://github.com/GAInuist/ConsDreamer

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22828 2026-04-28 cs.CV cs.AI 74%

MetaEarth3D: Unlocking World-scale 3D Generation with Spatially Scalable Generative Modeling

MetaEarth3D: 解锁世界尺度的3D生成与空间可扩展生成模型

Jinqi Cao, Zhiping Yu, Baihong Lin, Chenyang Liu, Zhenwei Shi, Zhengxia Zou

机构 * School of Astronautics, Beihang University(北航航天学院)

专题命中 3D生成 :3D generation(title);分类 cs.CV

AI总结 MetaEarth3D通过空间可扩展生成模型实现世界尺度3D生成,解决传统生成模型在空间尺度上的局限,提升地球观测与模拟的超大空间智能能力。

Comments Project Page: https://jinqicao.github.io/metaearth3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23533 2026-04-28 eess.SP cs.NI 50%

PILOT: One Physics-Integrated Generation Framework to Unify 2D and 3D Radio Map Construction

PILOT:一个整合物理的生成框架,统一2D和3D无线电地图构建

Weiming Huang, Hao Sun, Junting Chen

专题命中 3D生成 :3D generation(abstract)

AI总结 PILOT通过整合物理模型,采用波前序列替代传统栅格扫描,提升2D和3D无线电地图构建的精度与效率,实现更低的NMSE和更快的推理速度。

Comments 13 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 空间理解 2 篇

2603.27507 2026-04-28 cs.CV 57%

Chat-Scene++: Exploiting Context-Rich Object Identification for 3D LLM

Chat-Scene++: 利用语境丰富的物体识别用于3D大语言模型

Haifeng Huang, Yilun Chen, Zehan Wang, Jiangmiao Pang, Zhou Zhao

机构 * School of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 空间理解 :3D vision(abstract);分类 cs.CV

AI总结 本文提出Chat-Scene++框架,通过将3D场景表示为语境丰富的物体序列,提升细粒度物体定位和上下文推理能力,在五个3D视觉语言基准测试中取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23452 2026-04-28 cs.CV cs.LG 57%

From Edges to Depth: Probing the Spatial Hierarchy in Vision Transformers

从边缘到深度:探测视觉变换器中的空间层次

Jainum Sanghavi

机构 * Northeastern University(东北大学)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV

AI总结 研究探讨了视觉变换器中空间层次的编码机制,通过分析局部边缘和深度信息揭示了层次结构,发现边界结构在第5-6层可线性解码,而深度信息在第8层达到峰值,证明了分类训练的ViT能主动维护空间层次。

Comments 12 pages, 6 figures. Code available at https://github.com/JainumSanghavi/ProbingViTs

详情

展开后加载摘要…

URL PDF HTML 收藏

7. SLAM与定位 2 篇

2604.01644 2026-04-28 cs.CV cs.MM 57%

TOL: Textual Localization with OpenStreetMap

TOL: 基于OpenStreetMap的文本定位

Youqi Liao, Shuhao Kang, Jingyu Xu, Olaf Wysocki, Yan Xia, Jianping Li, Zhen Dong, Bisheng Yang, Xieyuanli Chen

机构 * Wuhan University(武汉大学) Technical University of Munich(慕尼黑技术大学) Institute of Artificial Intelligence (TeleAI)(人工智能研究院(TeleAI)) China Telecom(中国电信) University of Cambridge(剑桥大学) University of Science and Technology of China(中国科学技术大学) national university of defense technology(国防科技大学)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 本文提出T2O定位任务,利用文本描述和OSM地图实现无几何观测的精准定位,引入TOL基准数据集和TOLoc框架,实验表明在不同阈值下优于现有方法。

Comments Tech repo

详情

展开后加载摘要…

URL PDF HTML 收藏