arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 4393 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4393 篇

2606.21501 2026-06-23 cs.RO 新提交 57%

UniviewVLA: A Unified Multiview Vision-Language-Action Model with World Modeling

UniviewVLA:统一的多视图视觉-语言-动作模型与世界建模

Tao Xu, Runhao Zhang, Zhijian Huang, Jiayi Guan, Jiaxin Wang, Yifan Ding, Yong-Lu Li, Long Chen, Guang Chen, Jinghui Lu

机构 * Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Xiaomi EV(小米汽车)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 提出UniviewVLA,利用世界模型生成多视图未来帧,从标准双摄像头观测中预测动作,解决遮挡问题,无需额外硬件或显式重建,并通过运动信息令牌压缩和动作熵视图选择提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21027 2026-06-23 cs.CV 新提交 57%

Self-Supervised Dual-Frequency Phase Decomposition for Single-Shot Composite Fringe Projection Profilometry

自监督双频相位分解用于单帧复合条纹投影轮廓术

Jin-Hyuk Seok, Yatong An, Jae-Sang Hyun

机构 * Department of Mechanical Engineering, Yonsei University(延世大学机械工程系) Yonsei Institute for Embodied Intelligence, Yonsei University(延世大学具身智能研究所) Meta Reality Labs

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出自监督双频相位细化框架,利用低高频相位梯度关系及软边缘一致性损失,实现无标签的单帧复合条纹3D重建,精度优于变换方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07690 2026-06-23 cs.CV 版本更新 57%

FrameVGGT: Coherence-Preserving Memory for Bounded Streaming Geometry

FrameVGGT:几何对齐的帧级内存用于有界流式VGGT

Zhisong Xu, Takeshi Oishi

机构 * Institute of Industrial Science(工业科学研究所) The University of Tokyo(东京大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 FrameVGGT从几何支持角度重新审视有界内存流式处理,通过组织帧级增量KV贡献为连贯段,实现稳定几何支持与内存平衡。

Comments 23pages including appendix checklist

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03962 2026-06-23 cs.CV 版本更新 57%

A Linear Fractional Transformation Model and Calibration Method for Light Field Camera

光场相机的线性分式变换模型与标定方法

Zhong Chen, Changfeng Chen

机构 * School of Mechanical and Automotive Engineering, South China University of Technology(机械与自动化工程学院,华南理工大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种线性分式变换模型,通过单一参数解耦主透镜与微透镜阵列成像,实现独立标定,在物理与模拟数据集上达到2.1%的平均平移误差,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18276 2026-06-23 cs.RO cs.AI 版本更新 57%

GAPartManip: A Large-scale Part-centric Dataset for Material-Agnostic Articulated Object Manipulation

GAPartManip:面向材料无关铰接物体操作的大规模部件中心数据集

Wenbo Cui, Chengyang Zhao, Songlin Wei, Jiazhao Zhang, Haoran Geng, Yaran Chen, Haoran Li, He Wang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) CFCS, School of Computer Science, Peking University(北京大学计算机科学系) Carnegie Mellon University(卡内基梅隆大学) University of California, Berkeley(加州大学伯克利分校) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) Galbot

专题命中 三维重建 :3D vision(abstract);分类 cs.RO

AI总结 提出大规模部件中心数据集GAPartManip,结合照片级材质随机化和部件级交互姿态标注,通过模块化框架提升深度估计与交互姿态预测,在仿真和真实场景中实现鲁棒的铰接物体操作。

Comments Accepted by ICRA 2025. Project page: https://pku-epic.github.io/GAPartManip/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20322 2026-06-19 cs.RO 新提交 57%

Towards 3D karst underwater scene reconstruction from rotating sonar data

基于旋转声纳数据的3D喀斯特水下场景重建

Georgios Evangelos Margaritis, Lionel Lapierre, Simon Rohou, Zhi Yan, Andreas Nüchter, François Goulette

机构 * U2IS, ENSTA, Institut Polytechnique de Paris(巴黎综合理工学院ENSTA学院U2IS实验室) Lab-STICC, ENSTA, Institut Polytechnique de Paris(巴黎综合理工学院ENSTA学院Lab-STICC实验室) Informatics XVII – Robotics, Julius-Maximilians-Universität Würzburg(尤利乌斯-马克西米利安-维尔茨堡大学信息学XVII – 机器人学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 针对声纳数据稀疏噪声大、导航漂移导致3D重建困难的问题,提出结合连续时间SLAM校正轨迹与两阶段深度学习表面重建的流水线,生成可沉浸导航的3D网格。

Comments 1st Workshop on Long-term Deployments in the Wild (LoWi)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03199 2026-06-19 cs.CV 版本更新 57%

Does Head Pose Correction Improve Biometric Facial Recognition?

姿态校正是否能提升生物特征面部识别?

Justin Norman, Hany Farid

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 研究探讨了AI驱动的头部姿态校正与图像修复对面部识别准确率的影响,发现选择性应用CFR-GAN与CodeFormer可提升识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10873 2026-06-19 cs.CV cs.AI 版本更新 57%

CADBench: A Multimodal Benchmark for AI-Assisted CAD Program Generation

CADBench:一个用于AI辅助CAD程序生成的多模态基准

Anna C. Doris, Jacob Thomas Sony, Ghadi Nehme, Era Syla, Amin Heyrani Nobari, Faez Ahmed

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出CADBench,一个统一的多模态CAD程序生成基准,包含18000个样本和六类基准,评估11种视觉语言模型,揭示了CAD程序生成中的三种常见失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19316 2026-06-18 cs.CV 新提交 57%

NeuMesh++: Towards Versatile and Efficient Volumetric Editing with Disentangled Neural Mesh-based Implicit Field

NeuMesh++:基于解耦神经网格隐式场的多功能高效体积编辑

Chong Bao, Yuan Li, Bangbang Yang, Yujun Shen, Hujun Bao, Zhaopeng Cui, Yinda Zhang, Guofeng Zhang

机构 * State Key Lab of CAD&CG, College of Computer Science, Zhejiang University(浙江大学计算机科学学院CAD&CG国家重点实验室) Ant Research(蚂蚁研究院) Google(谷歌) ByteDance(字节跳动)

专题命中 三维重建 :novel view synthesis(abstract);分类 cs.CV

AI总结 提出一种基于网格顶点的解耦神经辐射场表示,实现几何、纹理和语义引导的高效体积编辑,包括网格引导几何编辑、纹理交换填充绘制及语义编辑。

Comments TPAMI 2025; Project Page: https://zju3dv.github.io/neumeshplusplus/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09439 2026-06-18 cs.CV 版本更新 57%

SuperCarver: Texture-Consistent 3D Geometry Super-Resolution for High-Fidelity Surface Detail Generation

SuperCarver: 纹理一致的3D几何超分辨率用于高保真表面细节生成

Qijian Zhang, Xiaozheng Jian, Xuan Zhang, Wenping Wang, Junhui Hou

机构 * Tencent Games, China(腾讯游戏,中国) Department of Computer Science & Engineering, Texas A & M University(电子与计算机工程系,德克萨斯A&M大学) Department of Computer Science, City University of Hong Kong(计算机科学系,香港城市大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 提出SuperCarver,一种3D几何超分辨率管线,通过先验引导的法线扩散模型和噪声鲁棒的逆渲染,为粗糙网格补充纹理一致的表面细节,实现高保真细节生成。

Comments Accepted in IEEE TVCG

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17696 2026-06-17 cs.AI cs.GR 新提交 57%

FllumaOne: A Code-Native Multimodal CAD Dataset with Executable Programs and Kernel-Validated Feature Histories

FllumaOne:一个代码原生多模态CAD数据集,包含可执行程序与内核验证的特征历史

Jizong Zhan

机构 * Qt/C++ OpenCASCADE-based CAD system(基于Qt/C++ OpenCASCADE的CAD系统)

专题命中 三维重建 :point cloud(abstract);分类 cs.GR

AI总结 提出FllumaOne数据集,通过可执行Python程序生成CAD模型,对齐程序、特征树、几何等模态,支持可编辑逆向工程等任务。

Comments 24 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17384 2026-06-17 cs.CV 新提交 57%

Improving and Evaluating Hand-Object Interaction Detection

改进和评估手-物体交互检测

Ahmad Darkhalil, Dima Damen, David Fouhey

机构 * School of Computer Science, University of Bristol, Bristol, UK(布里斯托大学计算机科学学院) Computer Science and Electrical and Computer Engineering, New York University, NY, US(纽约大学计算机科学与电气与计算机工程系)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出HOI-DETR框架,将手-物体和物体-物体交互引入Co-DETR架构,在四个数据集上显著提升检测性能,mAP提升超过20个百分点。

Comments Project page: https://ahmaddarkhalil.github.io/HOI-DETR/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16479 2026-06-16 cs.CV cs.AI 新提交 57%

Uncertainty Quality of VGGT: An Analysis on the DTU Benchmark Dataset

VGGT的不确定性质量:基于DTU基准数据集的分析

Markus Hillemann, Robert Langendörfer, Steven Landgraf, Markus Ulrich

机构 * Institute of Photogrammetry and Remote Sensing, Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院摄影测量与遥感研究所)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文分析VGGT模型在DTU数据集上的不确定性预测质量,确定有效置信度阈值,并证明提升不确定性质量可显著改善3D重建精度。

Comments Accepted for publication in the ISPRS Annals of the Photogrammetry, Remote Sensing and Spatial Information Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15681 2026-06-16 cs.CV 新提交 57%

3D Consistency Optimization for Self-Supervised Monocular Video Depth Estimation

自监督单目视频深度估计的3D一致性优化

Yuanye Liu, Ke Zhang, Junzhe Jiang, Li Zhang, Vishal Patel, Xiahai Zhuang

机构 * Fudan University(复旦大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种将视频深度估计转化为多视图3D重建的框架,通过光度渲染、世界坐标对齐和多尺度时间梯度一致性约束,实现全局3D结构一致性,在自监督和零样本临床场景中达到最先进的空间精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14162 2026-06-15 cs.CV 新提交 57%

VideoWeave: Unlocking Geometric Consistency in Video Generation via Joint Geometry-Video Modeling

VideoWeave: 通过联合几何-视频建模解锁视频生成中的几何一致性

Xunzhi Xiang, Zixuan Duan, Yabo Chen, Zhengxuan Wei, Guiyu Zhang, Zixiao Gu, Zhe Gao, Haibin Huang, Chi Zhang, Qi Fan, Xuelong Li

机构 * Nanjing University(南京大学) Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院(TeleAI)) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 提出VideoWeave,一种在潜在空间后训练框架,利用隐式几何模型特征约束生成分布,缓解几何重建误差,提升视频几何一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12340 2026-06-11 cs.CV 新提交 57%

Echoes of the Prior: A Computational Phenomenology of Forgetting

先验的回响:遗忘的计算现象学

Gege Gao, Bernhard Schölkopf, Andreas Geiger

机构 * Eberhard Karl University of Tübingen(蒂宾根大学) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) Tübingen AI Center(蒂宾根人工智能中心)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 通过在前馈3D重建模型中诱导突触衰减,可视化遗忘的主观现象学,将神经网络作为认知代理探索神经形态美学。

Journal ref Proc. ACM Comput. Graph. Interact. Tech, ACM SIGGRAPH, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11805 2026-06-11 cs.CV cs.AI 新提交 57%

TextHOI-3D: Text-to-3D Hand-Object Interaction via Discrete Multi-View Generation and Joint Mesh Optimization

TextHOI-3D: 基于离散多视图生成与联合网格优化的文本到三维手物交互

Zixiong Hao, Zhencun Jiang

机构 * Technical University of Munich(慕尼黑工业大学) Tongji University(同济大学) Shanghai Research Institute for Intelligent Autonomous Systems(上海自主智能无人系统科学中心)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 提出TextHOI-3D框架,通过多视图离散表示连接文本生成与几何恢复,实现文本驱动的三维手物网格生成,显著降低物体倒角距离和穿透体积。

Comments 11 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10142 2026-06-10 cs.CV 新提交 57%

DB-3DME: From Dataset to Benchmark for Human-aligned Automatic 3D Mesh Evaluation

DB-3DME:从数据集到基准测试,实现与人类对齐的自动3D网格评估

Nanshan Jia, Zhenyu Zhao, Sui Huang, Jingshen Wang, Zeyu Zheng

机构 * University of California, Berkeley(加州大学伯克利分校) Roblox Corporation(Roblox公司)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 提出DB-3DME数据集与基准,包含2619个合成3D网格及其人类评分,通过微调视觉编码器优化VLM评估性能,显著超越现有模型。

Comments CVPR 2026 workshop paper. 10 pages, 3 figures, 6 tables. Dataset available at GitHub and Hugging Face

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08957 2026-06-09 cs.CV 新提交 57%

Rethinking 3D Shape Generation: Diffusion over Superquadrics

重新思考3D形状生成:超二次曲面上的扩散

Zhiyang Liu, Wanze Li, Yuwei Wu, Chengran Yuan, Jiawei Sun, Rui Zheng, Marcelo H Ang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 提出将扩散模型从高基数几何表示转移到紧凑的超二次曲面参数上,以降低计算和内存成本,并支持无分辨率点云解码、部件级编辑和约束设计,实现高效生成。

Comments Accepted to ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08205 2026-06-09 cs.CV 新提交 57%

Empowering Feed-Forward Reconstruction Models with Metric Scale via Satellite Images

利用卫星图像赋予前馈重建模型度量尺度

Xianghui Ze, Yongjian Luo, Mengjun Chao, Zhenbo Song, Jianfeng Lu, Yujiao Shi

机构 * Nanjing University of Science and Technology(南京理工大学) ShanghaiTech University(上海科技大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出卫星引导框架,通过双向交叉视图交互利用卫星图像作为全局度量参考,解决前馈3D重建中的尺度模糊问题,实现度量深度估计、点云重建和相机定位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07907 2026-06-09 cs.CV cs.AI 新提交 57%

3D Oral Modelling with Improved Vertex Distribution Using Matching-Based Learning

基于匹配学习的改进顶点分布的3D口腔建模

Jihun Cho, Soo-Yeon Jeong, Eun-Jeong Bae, Sun-Young Ihm

机构 * st Jihun Cho(第一作者) nd Soo-Yeon Jeong(第二作者) rd Eun-Jeong Bae(第三作者) th Sun-Young Ihm(第四作者)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 针对3D口腔重建中预测顶点分布不均的问题,提出结合匈牙利匹配过滤与排斥损失的改进损失函数,使顶点分布更均匀,虽精度略降但有效缓解了聚集现象。

Comments 5 pages, 7 figures. English version of a paper presented at the Korea Multimedia Society Conference, November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07891 2026-06-09 cs.CV 新提交 57%

C3VD-DEFCOL: A Deformable Colonoscopy Dataset with Time-Resolved 3D Ground Truth and Realistic Appearance

C3VD-DEFCOL:具有时间分辨三维真实地面真值和逼真外观的可变形结肠镜数据集

Ethan Luk, Mayank V. Golhar, Anthony Song, Raúl Iranzo, Víctor M. Batlle, Lalithkumar Seenivasan, José M. M. Montiel, Nicholas J. Durr

机构 * Johns Hopkins University(约翰霍普金斯大学) Universidad de Zaragoza(萨拉戈萨大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出C3VD-DEFCOL框架和数据集,通过模拟蠕动变形和真实纹理渲染,为可变形结肠镜三维重建提供带时间分辨地面真值的评估平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01171 2026-06-09 cs.CV cs.LG 版本更新 57%

CADFit: Precise Mesh-to-CAD Program Generation with Hybrid Optimization

CADFit:基于混合优化的精确网格到CAD程序生成

Ghadi Nehme, Eamon Whalen, Faez Ahmed

机构 * Department of Mechanical Engineering, Massachusetts Institute of Technology, Cambridge, MA 02139, USA(麻省理工学院机械工程系)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 提出CADFit框架,通过基于几何反馈的增量拟合和验证参数化操作,从网格中恢复复杂可编辑的CAD构造序列,在多个基准上优于现有方法,并显著降低无效比率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07337 2026-06-08 cs.GR 新提交 57%

Skeletal-Anchored Dual Harmonics for Structured 3D Modeling

骨骼锚定双谐波用于结构化三维建模

Zhentao Huang, Changhao Li, Ruizhen Hu, Hui Huang, Minglun Gong

专题命中 三维重建 :point cloud(abstract);分类 cs.GR

AI总结 提出骨骼锚定双谐波(SADH)表示,通过内部锚点上的表面补丁和双通道球谐函数,联合优化表面几何与中轴骨骼结构,实现紧凑且连贯的三维形状建模。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06887 2026-06-08 cs.CV 新提交 57%

ARAPDiffusion: ARAP Regularization for Diffusion-Based Deformable Shape Space Learning

ARAPDiffusion: 基于ARAP正则化的扩散变形形状空间学习

Haibo Liu, Jinghan Ke, Haitao Yang, Xiangru Huang, Georgios Pavlakos, Qixing Huang

机构 * University of Texas at Austin(德克萨斯大学) Westlake University(西拉丘学院)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 提出ARAPDiffusion,一种潜在扩散模型,通过注入ARAP变形模型作为正则化损失,学习变形形状集合的连续形状空间,减少对大量3D训练数据的依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06039 2026-06-05 cs.CV 57%

Texture-preserving implicit neural representation for Cone beam CT truncated reconstruction

保留纹理的隐式神经表示用于锥束CT截断重建

Genyuan Zhang, Junyao Wang, Haoran Lan, Chuandong Tan, Songtao Zhu, Fenglin Liu

机构 * National Key Research and Development Program of China(中华人民共和国国家重点研发计划) National Natural Science Foundation of China(中华人民共和国国家自然科学基金) Fundamental Research Funds for the Central Universities(中央高校基本科研业务费)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种自监督的3D重建框架,基于神经场景表示,结合物理迭代细化模块,解决锥束CT截断重建中的伪影和纹理丢失问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05998 2026-06-05 cs.CV cs.AI 57%

Deep Learning-based 3D Oral Cavity Reconstruction Using 2D Intraoral Images

基于深度学习的二维口内图像三维口腔重建

Jihun Cho, Soo-Yeon Jeong, Eun-Jeong Bae, Sun-Young Ihm

机构 * KAIST(韩国科学技术院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种仅用十张二维口内图像进行三维口腔重建的软件方法,采用MobileNetV2与多头注意力机制,降低成本和不适,实现自动化重建。

Comments 4 pages, 5 figures. English version of a paper presented at the Korea Multimedia Society Conference, November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16624 2026-06-04 cs.CV cs.AI 57%

SAM 3D: 3Dfy Anything in Images

SAM 3D: 将图像中的任何内容3D化

SAM 3D Team, Xingyu Chen, Fu-Jen Chu, Pierre Gleize, Kevin J Liang, Alexander Sax, Hao Tang, Weiyao Wang, Michelle Guo, Thibaut Hardin, Xiang Li, Aohan Lin, Jiawei Liu, Ziqi Ma, Anushka Sagar, Bowen Song, Xiaodong Wang, Jianing Yang, Bowen Zhang, Piotr Dollár, Georgia Gkioxari, Matt Feiszli, Jitendra Malik

机构 * Meta Superintelligence Labs(Meta超智能实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出SAM 3D生成模型,从单张图像重建3D物体的几何、纹理和布局,通过人机协同标注和分阶段训练突破数据瓶颈,在真实场景中取得显著优势。

Comments Website: https://ai.meta.com/sam3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03509 2026-06-03 cs.CV 57%

EvoMemNav: Efficient Self-Evolving Fine-Grained Memory for Zero-Shot Embodied Navigation

EvoMemNav: 用于零样本具身导航的高效自进化细粒度记忆

Zuhao Ge, Xiaosong Jia, Chao Wu, Yuchen Zhou, Zuxuan Wu, Yu-Gang Jiang

机构 * Institute of Trustworthy Embodied AI (TEAI), Fudan University(可信具身人工智能研究院,复旦大学) Shanghai Key Laboratory of Multimodal Embodied AI(上海多模态具身人工智能重点实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出EvoMemNav框架,通过构建视觉-语义记忆图并采用预算驱动的粗到细策略,结合反射驱动写回机制,实现零样本具身导航中高效、自进化的细粒度记忆,提升多实例区分和停止验证性能。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03287 2026-06-03 cs.CV 57%

BA-T: An Iterative Transformer for Two-View Bundle Adjustment

BA-T: 一种用于双视图束调整的迭代Transformer

Ganlin Zhang, Weirong Chen, Daniel Cremers, Xi Wang

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 受经典束调整启发,提出BA-T,一种通过迭代Transformer在隐式token空间中实现结构化更新的轻量级方法,用于改进双视图三维重建的精度和多视图一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏