arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 7719 信号源:cs.CV, cs.GR, cs.RO

1. 点云 7719 篇

2603.21583 2026-06-18 cs.CV 版本更新 57%

HACMatch Semi-Supervised Rotation Regression with Hardness-Aware Curriculum Pseudo Labeling

HACMatch: 基于难度感知课程伪标签的半监督旋转回归

Mei Li, Huayi Zhou, Suizhi Huang, Yuxiang Lu, Yue Ding, Hongtao Lu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出一种难度感知课程学习框架,通过动态选择伪标签样本和结构化数据增强,在少量标注数据下提升半监督旋转回归性能。

Comments This is an accepted manuscript of an article published in Computer Vision and Image Understanding

Journal ref Computer Vision and Image Understanding (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18053 2026-06-17 cs.RO 新提交 57%

A Hybrid Optimization Framework for Grasp Synthesis under Partial Observations

一种用于部分观测下抓取合成的混合优化框架

Wenzheng Zhang, Fahira Afzal Maken, Tin Lai, Fabio Ramos

机构 * School of Computer Science, The University of Sydney(悉尼大学计算机科学学院) Data61, CSIRO(澳大利亚联邦科学与工业研究组织Data61) NVIDIA(英伟达)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出结合基于学习的能量模型与解析迭代最近点方法的混合框架,从部分观测点云生成鲁棒抓取,在67个物体5360次抓取尝试中平均成功率达60.9%,优于现有方法。

Journal ref ICRA2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09373 2026-06-17 cs.CV 版本更新 57%

FUSER: Feed-Forward MUltiview 3D Registration Transformer and SE(3)$^N$ Diffusion Refinement

FUSER: 前馈多视图3D配准Transformer与SE(3)^N扩散精化

Haobo Jiang, Jin Xie, Jian Yang, Liang Yu, Jianmin Zheng

机构 * Nanyang Technological University(南洋理工大学) Alibaba Group(阿里巴巴集团) Nanjing University(南京大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出FUSER,首个前馈多视图配准Transformer,在统一潜在空间中直接预测全局位姿,避免成对匹配;并引入SE(3)^N扩散精化框架FUSER-DF以校正估计。

Comments Accepted to CVPR 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15328 2026-06-16 cs.CV 新提交 57%

SGFormer++: Semantic Graph Transformer for Incremental 3D Scene Graph Generation

SGFormer++:用于增量式3D场景图生成的语义图Transformer

Mengshi Qi, Changsheng Lv, Zijian Fu, Xianlin Zhang, Huadong Ma

机构 * State Key Laboratory of Networking and Switching Technology, Beijing University of Posts and Telecommunications(北京邮电大学网络与交换技术国家重点实验室)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出SGFormer++,通过图嵌入层和语义注入层实现全局消息传递,并引入空间引导特征适配器和级联二值预测头解决增量场景图生成中的灾难性遗忘问题,在3DSSG基准上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15796 2026-06-16 cs.CV 版本更新 57%

Cross-Modal Registration Between 3D and 2D Fingerprints via Pose-Aware Unwrapping and Point-Cloud Fusion

通过姿态感知解缠和点云融合实现3D与2D指纹的跨模态注册

Xiongjun Guan, Jianjiang Feng, Jie Zhou

机构 * Department of Automation, Tsinghua University(自动化系,清华大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出统一框架,实现3D指纹预处理与跨接触式和非接触式2D指纹的注册,结合非参数可视化解缠、点云融合、姿态归一化和姿态感知注册策略,提升3D与2D指纹兼容性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02186 2026-06-16 cs.CV 版本更新 57%

Learning Topology-Aware Implicit Field for Unified Pulmonary Tree Modeling with Incomplete Topological Supervision

学习拓扑感知隐式场用于不完整拓扑监督下的统一肺树建模

Ziqiao Weng, Jiancheng Yang, Kangxian Xie, Bo Zhou, Weidong Cai

机构 * School of Computer Science, The University of Sydney(悉尼大学计算机科学学院) ELLIS Institute Finland(芬兰ELLIS研究所) Aalto University(阿尔托大学) Department of Computer Science and Engineering, University of Buffalo(布法罗大学计算机科学与工程系) Department of Radiology, Northwestern University(西北大学放射学系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出TopoField框架,利用稀疏点云学习连续隐式场,在无完整标注下修复肺树拓扑不完整,并联合实现解剖标记与肺段重建,效率高且鲁棒。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14562 2026-06-15 cs.CV cs.LG 新提交 57%

NEST3D: A High-Resolution Multimodal Dataset of Sociable Weaver Tree Nests

NEST3D:织布鸟树巢的高分辨率多模态数据集

Constanza A. Molina Catricheo, Simon Boeder, Ting-Jia Guo, Giacomo May, Clément Berthelot, Devis Tuia, Friedrich Fedor Reinhard, Fabio Remondino, Benjamin Risse

机构 * Institute for Geoinformatics (ifgi), University of Münster(明斯特大学地理信息学研究所) École Polytechnique Fédérale de Lausanne (EPFL)(洛桑联邦理工学院) Max Planck Institute of Animal Behavior(马克斯·普朗克动物行为研究所) University of Konstanz(康斯坦茨大学) Kuzikus Research Station(库兹库斯研究站) Fondazione Bruno Kessler (FBK)(布鲁诺·凯斯勒基金会)

专题命中 点云 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对织布鸟巢缺乏精细3D结构数据的问题,提出包含104棵巢树、1.4TB多模态无人机数据集,并基准测试语义分割方法,PT-v3达86.35% mIoU。

Comments 14 pages, 4 figures. Dataset available at https://huggingface.co/NEST3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12988 2026-06-12 cs.CV cs.AI 新提交 57%

A Machine Learning Framework for Real-Time Personalized Ergonomic Pose Analysis

一种用于实时个性化人体工学姿态分析的机器学习框架

Manex Atxa, Bruno Simoes, Julen Balzategui

机构 * Vicomtech Foundation(Vicomtech基金会) Basque Research and Technology Alliance(巴斯克研究与技术联盟) BRTA

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出利用三维体积视频数据实时预测人体工学/非工学姿态的方法,结合3D点云多角度分析与个性化深度学习分类器,克服固定视角遮挡问题,实现实时评估。

Comments 13 pages, 7 figures, conference 24CMH

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12981 2026-06-12 cs.CV 新提交 57%

Camera and LiDAR BEV Fusion for Cooperative 3D Object Detection on TUMTraf V2X

用于TUMTraf V2X协同3D目标检测的相机与LiDAR BEV融合

Muhammad Shahbaz, Shaurya Agarwal

机构 * Department of Civil, Environmental and Construction Engineering, University of Central Florida(中佛罗里达大学土木、环境与建筑工程系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出一种融合路边相机与基础设施-车辆点云的BEV空间检测器,采用CenterPoint风格头部和IoU重排序,在DriveX 2026挑战赛公开测试集上达到0.85 mAP,并分析了训练/验证与测试集重叠对分数的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12334 2026-06-11 cs.LG cs.RO 新提交 57%

Fourier Features Let Agents Learn High Precision Policies with Imitation Learning

傅里叶特征让智能体通过模仿学习学习高精度策略

Balázs Gyenes, Emiliyan Gospodinov, Jan Frieling, Enrico Krohmer, Nicolas Schreiber, Xiaogang Jia, Niklas Freymuth, Gerhard Neumann

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) FZI Research Center for Information Technology(FZI信息技术研究中心)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出在点云编码器中使用傅里叶特征映射,解决神经网络低频偏好导致的高精度操作问题,在多个基准和真实机器人上显著提升性能。

Comments Published as a conference paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11708 2026-06-11 cs.RO 新提交 57%

Explore From Sketch: Accelerating UAV Exploration in Large-scale Environments with Prior Maps

从草图探索:利用先验地图加速无人机在大规模环境中的探索

Tiancheng Lai, Yuman Gao, Xiangyu Li, Ruitian Pang, Xingpeng Wang, Siqi Shen, Mengke Zhang, Yin He, Fei Gao, Chao Xu, Yanjun Cao

机构 * Institute of Cyber-Systems and Control, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院工业控制技术研究所) Huzhou Institute, Zhejiang University, and Huzhou Key Laboratory of Autonomous System(浙江大学湖州研究院,湖州市自主系统重点实验室) Zhejiang Zhongyan Industry Co., Ltd(浙江中烟工业有限责任公司) Differential Robotics Technology Company(微分机器人技术有限公司)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出利用稀疏、未对齐甚至不一致的2D先验地图加速无人机大规模环境探索的框架,通过鲁棒的2D-3D点云配准和层次化视点规划,实现效率提升34.2%。

Comments 25 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09882 2026-06-10 cs.CV cs.LG 新提交 57%

WHU-Infra3D: A Full-stack Multi-modal Dataset and Benchmark for 3D Roadside Infrastructure Inventory

WHU-Infra3D:面向3D路边基础设施清单的全栈多模态数据集与基准

Chong Liu, Luxuan Fu, Xuyu Feng, Zhen Dong, Bisheng Yang

机构 * State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing (LIESMARS)(信息工程测绘遥感国家重点实验室) Wuhan University(武汉大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出WHU-Infra3D多模态基准数据集,覆盖三城市53.8公里,融合全景图像与LiDAR点云,提供2D-3D实例关联和跨帧跟踪,支持基础设施状态诊断与属性识别,填补自动化维护数据集空白。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13595 2026-06-10 cs.CV 版本更新 57%

NoiseSDF2NoiseSDF: Learning Clean Neural Fields from Noisy Supervision

NoiseSDF2NoiseSDF: 从含噪监督中学习干净的神经场

Tengkai Wang, Weihao Li, Ruikai Cui, Shi Qiu, Nick Barnes

机构 * University of Cambridge(剑桥大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出NoiseSDF2NoiseSDF方法,通过最小化含噪SDF表示之间的MSE损失,从含噪点云中学习干净的神经SDF,实现隐式去噪和表面优化。

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09828 2026-06-09 cs.CV 新提交 57%

Latent Spatial Memory for Video World Models

视频世界模型的潜在空间记忆

Weijie Wang, Haoyu Zhao, Yifan Yang, Feng Chen, Zeyu Zhang, Yefei He, Zicheng Duan, Donny Y. Chen, Yuqing Yang, Bohan Zhuang

机构 * Zhejiang University(浙江大学) Microsoft Research(微软研究院) Adelaide University(阿德莱德大学) Monash University(莫纳什大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出潜在空间记忆框架Mirage,通过在扩散潜在空间中直接构建和查询3D缓存,避免像素空间重建,实现高效视频生成,速度提升10.57倍,内存减少55倍。

Comments Project Page: https://aka.ms/latent-spatial-memory, Code: https://github.com/microsoft/LatentSpatialMemory

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09314 2026-06-09 cs.RO 新提交 57%

KPGrasp: Scalable Keypoint Flow Matching for Dexterous Grasp Generation

KPGrasp: 可扩展的关键点流匹配用于灵巧抓取生成

Yuansen Huang, Jiayi Chen, Haoran Liu, Yubin Ke, Bing Han, Jiangran Lyu, Mi Yan, Li Yi, He Wang

机构 * Peking University(北京大学) Galbot Xi’an Jiaotong University(西安交通大学) Tsinghua University(清华大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出KPGrasp框架,通过全欧几里得手部关键点参数化和Transformer流模型,从大规模数据学习灵巧抓取先验,无需接触损失或测试时优化,在模拟和真实场景中实现高成功率与低穿透深度。

Comments 14 pages, 7 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08828 2026-06-09 cs.RO 新提交 57%

Video2Sim2Real: Full-Stack Autonomous Dexterous Skill Acquisition from a Single Human Video

Video2Sim2Real:从单个人类视频实现全栈自主灵巧技能获取

Yunhai Han, Jianuo Qiu, Linhao Bai, Ziyu Xiao, Zihang Zeng, Yangcen Liu, Zhaodong Yang, Shalin Jain, Wenrui Ma, Jiaqi Fu, Yuqian Zheng, Manisha Natarajan, Muhammad Zubair Irshad, Kenneth Shaw, Matthew Gombolay, Zsolt Kira, Harish Ravichandar

机构 * Georgia Institute of Technology(佐治亚理工学院) University of Pennsylvania(宾夕法尼亚大学) Toyota Research Institute(丰田研究所) Carnegie Mellon University(卡内基梅隆大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出Video2Sim2Real框架,从单个人类操作视频中重建数字孪生并提取运动先验,通过物体关键帧优化机器人配置,结合残差强化学习与碰撞感知规划,实现从仿真到真实世界的灵巧技能迁移。

Comments Website: https://video2sim2real.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08014 2026-06-09 cs.CV cs.AI 新提交 57%

GVC-Seg: Training-Free 3D Instance Segmentation via Geometric Visual Correspondence

GVC-Seg: 基于几何视觉对应的免训练3D实例分割

Liang Xu, Fangjing Wang, Jinyu Yang, Feng Zheng

机构 * Victoria University of Wellington(惠灵顿维多利亚大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Southern University of Science and Technology(南方科技大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出GVC-Seg,一种免训练的3D实例分割方法,通过几何与视觉特征对应消除多模型集成中的置信度偏差,在多个基准上达到最优性能。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05153 2026-06-09 cs.RO cs.AI 57%

FCBV-Net: Category-Level Robotic Garment Smoothing via Feature-Conditioned Bimanual Value Prediction

FCBV-Net:通过特征条件双臂价值预测实现类别级机器人服装平滑

Mohammed Daba, Jing Qiu

机构 * University of Waterloo(多伦多大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出FCBV-Net,通过预训练的密集几何特征条件预测双臂动作价值,提升机器人服装平滑任务的类别级泛化能力,实验显示其在未见过的服装上效率下降仅为11.5%。

Comments 9 pages, 7 figures, 1 table

Journal ref Electronics 2026, 15(11), 2468

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07318 2026-06-09 cs.CV cs.AR eess.IV 版本更新 57%

Embedded Graph Convolutional Networks for Real-Time Event Data Processing on SoC FPGAs

嵌入式图卷积网络用于SoC FPGA上的实时事件数据处理

Kamil Jeziorek, Piotr Wzorek, Krzysztof Blachut, Andrea Pinna, Tomasz Kryjak

机构 * University of Warsaw(华沙大学) Politechnika Warszawska(华沙理工大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出一种针对事件相机的硬件感知图卷积网络EFGCN,在SoC FPGA上实现实时处理,模型大小相比AEGNN降低100倍,精度仅下降2.9%。

Comments Submitted to the IEEE Transactions on Very Large Scale Integration Systems. This manuscript was first submitted for publication on March 31, 2024. It has since been revised three times: on 22 Mau 2024, 10 June 2024 and 19 June 2025 (major update)

Journal ref Journal of Systems Architecture, Volume 177, August 2026, 103850

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07012 2026-06-08 cs.RO 新提交 57%

Task Editing for Generalizable 3D Visuomotor Policy Learning

面向可泛化3D视觉运动策略学习的任务编辑

Jian-Jian Jiang, YiHan Yang, Lan Wei, Yuming Luo, Xiao-Ming Wu, Xuhang Chen, Bin Fan, Dandan Zhang, Wei-Shi Zheng

机构 * Sun Yat-sen University(中山大学) Imperial College London(帝国理工学院) Nanyang Technological University(南洋理工大学) South China University of Technology(华南理工大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出Task-Edit框架,通过将任务分解为场景、技能和对象组件并灵活重组,生成多样化轨迹,提升3D视觉运动策略在长程操作任务中的泛化能力。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05515 2026-06-05 cs.CV 57%

BRepCLIP: Contrastive Multimodal Pretraining on BRep Primitives for CAD Understanding

BRepCLIP: 面向CAD理解的BRep基元对比多模态预训练

Muhammad Usama, Didier Stricker, Mohammad Sadil Khan, Muhammad Zeshan Afzal

机构 * DFKI, Germany(德意志联邦共和国DFKI) RPTU Kaiserslautern-Landau, Germany(德国凯撒斯劳滕-兰道大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出BRepCLIP框架,通过对比预训练对齐CAD边界表示(BRep)几何与语言/图像嵌入,显著提升检索和零样本分类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05407 2026-06-05 cs.RO 57%

MoDex: A Diffusion Policy for Sequential Multi-Object Dexterous Grasping

MoDex:用于顺序多物体灵巧抓取的扩散策略

Haofei Lu, Hongjia Liu, Yifei Dong, Florian T. Pokorny, Jens Lundell, Danica Kragic

机构 * Department of Robotics, Perception and Learning, KTH Royal Institute of Technology(机器人、感知与学习系,皇家理工学院) Robotics and Autonomous Systems at University of Turku(图尔库大学机器人与自主系统)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出MoDex扩散策略,通过对抗空间和点云条件预测抓取姿态,实现单只灵巧手顺序抓取多物体而不释放已抓物体,并通过两阶段训练(模仿学习+强化学习微调)提升成功率。

Comments Submitted to CoRL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03100 2026-06-05 cs.CV cs.LG 57%

Zero-Shot 3D Question Answering via Hierarchical View-to-Token Transportation

零样本3D问答通过层级视图到令牌传输

Dongsheng Wang, Dawei Su, Hui Huang

机构 * Dongsheng Wang(王东生) Dawei Su(苏大卫) Hui Huang(黄慧)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出KeyVT方法,通过层级视图和令牌级输入上下文收集,结合像素特征与相机参数评估视图重要性,并利用最优传输识别代表性令牌,实现零样本3D问答性能提升。

Comments Accepted at ICML 2026. 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16502 2026-06-05 cs.CV 57%

Topology-Aware Layer Pruning for Large Vision-Language Models

面向拓扑的层剪枝用于大型视觉-语言模型

Pengcheng Zheng, Chaoning Zhang, Ya Wen, Wang Liu, Qigan Sun, Jiarong Mo, Jiaquan Zhang, Jewon Lee, Tae-Ho Kim, Kuien Liu, Tianyu Li, Caiyan Qin, Yang Yang

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出了一种面向拓扑的层剪枝框架,用于大型视觉-语言模型,通过利用拓扑持续同调量化层间拓扑一致性,实现自适应剪枝以保留关键表示转换。

Comments This manuscript has been withdrawn by the authors. It reproduced the methodology of Gardinazzi et al., arXiv:2410.11042, without citation, and utilized code and data from the associated repository (github.com/RitAreaSciencePark/ZigZagLLMs) without disclosure or violate the MIT License. A revised future version with full attribution may be prepared. For any feedback, please contact Pengcheng Zheng

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05142 2026-06-04 cs.CV cs.AI 57%

GeM-NR: Geometry-Aware Multi-View Editing for Nonrigid Scene Changes

GeM-NR:面向非刚性场景变化的几何感知多视角编辑

Josef Bengtson, Yaroslava Lochman, Fredrik Kahl

机构 * Chalmers University of Technology(查尔姆斯理工大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出GeM-NR,一种无需训练的快速灵活方法,通过深度图对齐、视角投影和条件细化实现多视角一致的通用非刚性图像编辑,支持几何和外观的显著变化。

Comments Project page: https://gem-nr.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05058 2026-06-04 cs.CV cs.AI 57%

UniCAD: A Unified Benchmark and Universal Model for Multi-Modal Multi-Task CAD

UniCAD:面向多模态多任务CAD的统一基准与通用模型

Jingyuan Chen, Sheng Jin, Haopeng Sun, Wentao Liu, Chen Qian

机构 * SenseTime Research and Tetras.AI(秒速科技研究院和Tetras.AI)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对CAD领域缺乏统一多模态基准的问题,提出UniCAD基准和UniCAD-MLLM通用多模态大语言模型,在点云到CAD重建、文本/图像到CAD生成和CAD问答等任务上实现端到端统一处理,并在多个基准上取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04464 2026-06-04 cs.CG cs.GR 57%

Homology-Preserving Dimensionality Reduction via Adaptive Mapper and Landmark Isomap

同调保持的降维:基于自适应Mapper和地标Isomap

Shakiba Khourashahi, Ilia Jahanshahi, Bei Wang, Lin Yan

专题命中 点云 :point cloud(abstract);分类 cs.GR

AI总结 提出AdaMapper和AdaHIsomap两种方法,通过持久性图指导骨架构建和地标选择,并引入自适应细化策略和随机锚点,以在降维中更好地保持同调特征(如连通分量和环)。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04369 2026-06-04 cs.CV 57%

VT-3DAD: Cross-Category 3D Anomaly Detection via Visual-Text Normal Space Alignment

VT-3DAD:通过视觉-文本正常空间对齐的跨类别3D异常检测

Zi Wang, Katsuya Hotta, Yawen Zou, Koichiro Kamide, Yijin Wei, Chao Zhang, Jun Yu

机构 * Niigata University(Niigata大学) University of Toyama(Toyama大学) Iwate University(Iwate大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出VT-3DAD无训练框架,通过冻结CLIP编码器提取多视图视觉特征和文本正常锚点,融合视觉与语义偏差实现跨类别3D异常检测,在ShapeNetPart上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03511 2026-06-04 cs.CV cs.AI cs.LG eess.IV 57%

Platonic Transformers: A Solid Choice For Equivariance

柏拉图式Transformer:等变性的坚实选择

Mohammad Mohaiminul Islam, Rishabh Anand, David R. Wessels, Friso de Kruiff, Thijs P. Kuipers, Rex Ying, Clara I. Sánchez, Sharvaree Vadgama, Georg Bökman, Erik J. Bekkers

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出Platonic Transformer,通过基于柏拉图立体对称群参考帧的注意力机制实现等变性,在不增加计算成本的前提下提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20803 2026-06-04 cs.CV 57%

Scalable Event Cloud Network for Event-based Classification

可扩展事件云网络用于基于事件的分类

Hongwei Ren, Fei Ma, Xiaopeng Lin, Yuetong Fang, Hongxiang Huang, Yue Zhou, Yulong Huang, Haotian Fu, Ziyi Yang, Youxin Jiang, Xiangqian Wu, Bojun Cheng

机构 * Research Centre for Multimodal Artificial Intelligence(多模态人工智能研究中心) Applications, Faculty of Computing, Harbin Institute of Technology(应用学院,哈尔滨工业大学) MICS Thrust, Hong Kong University of Science(科学与技术大学(香港)MICS研究方向) Guangdong Laboratory of Artificial Intelligence(广东人工智能与数字经济实验室)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出SECNet,通过结构级极性集成和频域特征提取,解决事件云表示在空间和时间分辨率上的可扩展性问题,在十个数据集上验证了有效性。

Comments ICML2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏