2507.11539 2026-04-01 cs.CV cs.AI cs.LG 70% Streaming 4D Visual Geometry Transformer 流式4D视觉几何变换器 Dong Zhuo, Wenzhao Zheng, Jiahe Guo, Yuqi Wu, Jie Zhou, Jiwen Lu 机构 * Tsinghua University(清华大学) 纠错 专题命中 三维重建 :3D vision(abstract);3D reconstruction(abstract);分类 cs.CV AI总结 本文提出一种流式视觉几何变换器,通过因果变换器架构实现低延迟的4D视觉几何重建,结合知识蒸馏和高效注意力机制,提升在线场景下的推理速度与重建质量。 Comments Code is available at: https://github.com/wzzheng/StreamVGGT 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2603.29847 2026-04-01 cs.GR cs.CV cs.HC 62% CADReasoner: Iterative Program Editing for CAD Reverse Engineering CADReasoner: 用于CAD逆向工程的迭代程序编辑 Soslan Kabisov, Vsevolod Kirichuk, Andrey Volkov, Gennadii Savrasov, Marina Barannikov, Anton Konushin, Andrey Kuznetsov, Dmitrii Zhemchuzhnikov 机构 * Lomonosov Moscow State University(莫斯科国立大学) ; Université Paris Dauphine(巴黎多芬大学) ; Innopolis University(因诺波利斯大学) ; FusionBrain Lab(FusionBrain实验室) 纠错 专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.GR AI总结 CADReasoner通过迭代优化几何差异,提升CAD逆向工程的精度与效率,实现多视角渲染与点云的融合,并在多个基准测试中取得最佳成绩。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2603.30045 2026-04-01 cs.CV 57% OmniRoam: World Wandering via Long-Horizon Panoramic Video Generation OmniRoam:通过长视界全景视频生成实现世界漫游 Yuheng Liu, Xin Lin, Xinke Li, Baihan Yang, Chen Wang, Kalyan Sunkavalli, Yannick Hold-Geoffroy, Hao Tan, Kai Zhang, Xiaohui Xie, Zifan Shi, Yiwei Hu 机构 * University of California, Irvine(加州大学尔湾分校) ; University of California, San Diego(加州大学圣地亚哥分校) ; City University of Hong Kong(香港城市大学) ; University of Pennsylvania(宾夕法尼亚大学) ; Adobe Research(Adobe研究院) 纠错 专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV AI总结 本文提出OmniRoam框架,利用全景视频生成实现长视界场景漫游,通过预览和精炼阶段提升视频质量和一致性,实验表明其在视觉质量、可控性和长期一致性方面优于现有方法。 Comments Code is available at https://github.com/yuhengliu02/OmniRoam 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2603.01142 2026-04-01 cs.CV 57% ArtLLM: Generating Articulated Assets via 3D LLM ArtLLM: 通过3D语言模型生成拟合资产 Penghao Wang, Siyuan Xie, Hongyu Yan, Xianghui Yang, Jingwei Huang, Chunchao Guo, Jiayuan Gu 机构 * ShanghaiTech University(上海科技大学) ; Tencent Hunyuan(腾讯混元) ; HKUST(香港科技大学) 纠错 专题命中 三维重建 :point cloud(abstract);分类 cs.CV AI总结 ArtLLM通过3D语言模型直接从完整3D网格生成高质量拟合资产,解决了传统方法在关节拟合和部分检索中的局限,提升了部分布局和关节预测的准确性。 Comments CVPR 2026. Project page: https://authoritywang.github.io/artllm/ 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2506.09082 2026-04-01 cs.CV cs.AI cs.LG 57% AVA-Bench: Atomic Visual Ability Benchmark for Vision Foundation Models AVA-Bench:用于视觉基础模型的原子视觉能力基准 Zheda Mai, Arpita Chowdhury, Zihe Wang, Sooyoung Jeon, Lemeng Wang, Jiacheng Hou, Wei-Lun Chao 机构 * The Ohio State University(俄亥俄州立大学) ; Adobe Research(Adobe研究院) ; Boston University(波士顿大学) 纠错 专题命中 三维重建 :spatial understanding(abstract);分类 cs.CV AI总结 AVA-Bench通过解耦14种原子视觉能力,揭示视觉基础模型的性能差异,提升模型选择的科学性与效率。 Comments Accepted by CVPR 2026. The first two authors contribute equally 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图