arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 7719 信号源:cs.CV, cs.GR, cs.RO

1. 点云 7719 篇

2603.08541 2026-07-22 cs.RO 版本更新 57%

EquiBim: Learning Symmetry-Equivariant Policy for Bimanual Manipulation

EquiBim: 学习双臂操作的对称等变策略

Zhiyuan Zhang, Aditya Mohan, Seungho Han, Wan Shou, Dongyi Wang, Yu She

机构 * Purdue University(普渡大学) University of Arkansas(阿肯色大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出EquiBim框架,通过强制对称性等变性提升双臂操作的性能和鲁棒性,适用于多种感知与动作表示。

Comments Accepted to IROS 2026. Project page: https://zhangzhiyuanzhang.github.io/equibim-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18153 2026-07-21 cs.CV 新提交 57%

Robust Multimodal Dynamic Object Segmentation

鲁棒多模态动态目标分割

Zhe Xin, Hanzhi Chang, Penghui Huang, Yinian Mao, Guoquan Huang

机构 * Meituan UAV(美团无人机) University of Delaware(特拉华大学)

专题命中 点云 :3D reconstruction(abstract);分类 cs.CV

AI总结 研究针对动态目标分割难题,提出整合多模态线索的框架,设计结合Transformer与特征聚类模块的网络进行分类,引入新后处理方法,在动态目标分割和静态场景重建任务中取得最优性能。

Comments Accepted by IEEE International Conference on Robotics & Automation ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17813 2026-07-21 cs.RO cs.SY eess.SY 新提交 57%

A2RL V\textsubscript{max}: The A2RL autonomous racing dataset for long-range, high-speed perception and multi-vehicle interaction

A2RL V下标max:用于远程、高速感知和多车辆交互的A2RL自动驾驶数据集

Marvin Klemp, Dominic Ebner, Cornelius Schröder, Davide Malvezzi, László Turányi, Riccardo Donati, Ilia Schminik, Xia Ning, Yanxin Zhou, Matthew Flagg, Christoph Stiller, Markus Lienkamp, Marko Bertogna, Gergely Bári, Andreas Birk, Ren Jin, Chen Lv, Johannes Betz

机构 * Institute of Measurement and Control Systems, Karlsruhe Institute of Technology(测量与控制系统研究所,卡尔斯鲁厄理工学院) Institute of Automotive Technology, Technical University of Munich(汽车技术研究所,慕尼黑工业大学) Professorship of Autonomous Vehicle Systems, Technical University of Munich(自动驾驶车辆系统教授职位,慕尼黑工业大学) University of Modena and Reggio Emilia(摩德纳大学和雷焦艾米利亚大学) Humda Lab, Széchenyi István University(胡姆达实验室,塞切尼·伊什特万大学) Politecnico di Milano(米兰理工大学) Constructor University(康斯坦丁大学) Beijing Institute of Technology(北京理工大学) Nanyang Technological University(南洋理工大学) Code 19 Racing(代码19赛车) Munich Institute of Robotics and Machine Intelligence (MIRMI), Technical University of Munich(慕尼黑机器人与机器智能研究所(MIRMI),慕尼黑工业大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 介绍A2RL V下标max开源数据集,专为高速自动驾驶和多车辆交互感知任务设计,含多样场景数据及专业标注激光雷达点云,以开发者友好格式提供,还对相关检测和跟踪方法做了实现与评估。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17351 2026-07-21 cs.AI cs.RO 新提交 57%

DeeperRadar: End-to-End MIMO Radar Design and Multi-Modal Fusion for Autonomous Vehicle Perception

深度雷达:用于自动驾驶车辆感知的端到端MIMO雷达设计与多模态融合

Eli Goldenshluger, Barak Pinkovich, Chaim Baskin

机构 * Technion–Israel Institute of Technology(以色列理工学院) Ben-Gurion University of the Negev(内盖夫本-古里安大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 深度雷达以雷达为中心,通过端到端学习稀疏采集模式,共同设计雷达传感与多模态3D检测。其可学习的MIMO设计模块在融合网络中训练,由其他传感器监督。在RADIal数据集上评估,能发现稀疏配置,降低成本与复杂性,表明最优设计取决于融合堆栈和感知任务。

Comments Accepted for publication at the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22881 2026-07-21 cs.RO eess.SP 版本更新 57%

A Vendor-Agnostic LiDAR Data Conversion System with Multi-Signal Detection and Multi-Format Output

一种支持多信号检测和多格式输出的厂商无关LiDAR数据转换系统

Param Patel, Jay Dave, Pratyush Chakraborty

机构 * BITS Pilani, Hyderabad Campus(比拉理工学院海德拉巴校区) Department of Electrical and Electronics Engineering, BITS Pilani, Hyderabad Campus(比拉理工学院海德拉巴校区电气与电子工程系) Department of Computer Science and Information Systems, BITS Pilani, Hyderabad Campus(比拉理工学院海德拉巴校区计算机科学与信息系统系)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出一种厂商无关的LiDAR数据转换系统,通过加权多信号方法自动识别传感器厂商,并输出五种标准格式,解决了多厂商SDK不兼容问题。

Comments Manuscript submitted at Software: Practice and Experience

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25623 2026-07-21 cs.RO 版本更新 57%

Neural Surface and Reflectance Modelling from 3D Radar Data

从3D雷达数据进行神经表面和反射率建模

Judith Treffler, Vladimír Kubelka, Henrik Andreasson, Martin Magnusson

机构 * Örebro University(厄勒布鲁大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出一种神经隐式方法,从雷达点云联合建模场景几何和视角相关雷达强度,利用混合特征编码学习连续SDF,生成更平滑准确的3D表面重建。

Comments Accepted for publication at the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05610 2026-07-21 cs.CV 版本更新 57%

NormalView: tree species classification from backpack and aerial lidar data using geometric projections

NormalView:利用几何投影从背包和航空激光雷达数据进行树种分类

Juho Korkeala, Jesse Muhojoki, Josef Taher, Klaara Salolahti, Matti Hyyppä, Antero Kukko, Juha Hyyppä

机构 * Finnish Geospatial Research Institute FGI(芬兰地理研究 institute FGI) The National Land Survey of Finland(芬兰国家土地调查局) Department of Remote Sensing and Photogrammetry(遥感与摄影测量系) Department of Built Environment, School of Engineering(环境系,工程学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究利用NormalView方法,通过将几何信息嵌入二维投影并输入YOLOv11网络进行树种分类,在移动和航空激光雷达数据上测试,发现多传感器强度信息有益,该方法仅依赖几何信息,公开了相关数据集,取得较好分类结果。

Comments 25 pages, 10+4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11585 2026-07-21 cs.CV cs.AI 版本更新 57%

OV-MAP: Open-Vocabulary Zero-Shot 3D Instance Segmentation Map for Robots

OV-MAP:用于机器人的开放词汇零样本3D实例分割地图

Juno Kim, Yesol Park, Hye-Jung Yoon, Byoung-Tak Zhang

机构 * Interdisciplinary Program in AI, Seoul National University(人工智能交叉学科项目,首尔国立大学) Artificial Intelligence Institute, Seoul National University(人工智能研究所,首尔国立大学) Department of Computer Science, Seoul National University(计算机科学系,首尔国立大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究针对移动机器人开放世界3D映射,提出OV-MAP方法,通过集成开放特征到3D地图提升物体识别能力,利用类无关分割模型等克服相邻体素特征重叠问题,经实验验证其在多环境下零样本性能、鲁棒性和适应性优越。

Comments 7 pages, 7 figures. Published in the Proceedings of the 2024 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2024)

Journal ref 2024 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2024, pp. 13780-13786

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16193 2026-07-20 cs.CV 新提交 57%

Knowing the Self, Understanding the World: A Dual-Cognition Benchmark for UAV Spatio-temporal Reasoning with MLLMs

认识自我,理解世界:用于基于多模态大语言模型的无人机时空推理的双认知基准测试

Like Liu, Zhengzheng Xu, Haitao He, Hongzhe Li, Shuchang Zhang, Dian Shao

机构 * Northwestern Polytechnical University(西北工业大学) China University of Petroleum(中国石油大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 该研究针对多模态大语言模型在无人机场景双认知能力评估不足的问题,提出UAV-DualCog基准测试,涵盖图像和视频任务,通过自动化管道构建数据,评估发现现有模型存在瓶颈,该基准测试有价值。

Comments 11 pages, 4 figures, 7 tables. Project website: https://uav-dualcog.lozumi.com

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15889 2026-07-20 cs.CV 新提交 57%

Hardware-triggered Time Synchronization of Roadside Multi-lidar, Multi-camera Measurement System for Accurate Data Alignment

用于精确数据对齐的路边多激光雷达、多摄像头测量系统的硬件触发时间同步

Shiva Agrawal, Savankumar Bhanderi, Zhiran Yan, Gordon Elger

机构 * Technische Hochschule Ingolstadt(英戈尔施塔特技术大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究路边多激光雷达与多摄像头系统数据对齐问题,提出开源、简单、模块化的硬件触发时间同步电路,通过实验评估其对时空对齐的影响,实现跨传感器一致性最大化,为多传感器同步提供低成本可扩展方案。

Comments Accepted at the IEEE International Conference on Intelligent Transportation Systems (ITSC 2026). Code and hardware design: https://github.com/shiva-THI/hardware-trigger-time-sync-lidar-cameras

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15331 2026-07-20 cs.CV 新提交 57%

Training-Free Open-Vocabulary 3D Point-Cloud Segmentation on the Generalized Few-Shot Benchmark

广义少样本基准上的无训练开放词汇3D点云分割

Silas kwabla Gah, Ebenezer Owusu

机构 * University of Ghana(加纳大学)

专题命中 点云 :3D vision(abstract);分类 cs.CV

AI总结 研究广义少样本3D点云分割问题,提出无训练方法,用冻结的3D视觉语言模型与概念分割器,通过跨视图一致性协调,在ScanNet200和ScanNet++基准上提升新类mIoU,且无需少样本支持,效果优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13891 2026-07-17 cs.LG cs.CV eess.SP stat.ML 交叉投稿 57%

PiVoT: A Variational Solution for Real-time Large-scale Multi-object Detection and Tracking under Heavy Clutter

PiVoT:一种用于在严重杂波下实时大规模多目标检测与跟踪的变分解决方案

Runze Gan, Qing Li, Simon J. Godsill, Mike E. Davies, James R. Hopgood

机构 * Institute for Imaging, Data and Communications (IDCOM), University of Edinburgh(爱丁堡大学成像、数据与通信研究所(IDCOM)) Department of Engineering, University of Cambridge(剑桥大学工程系) School of Mathematics, University of Edinburgh(爱丁堡大学数学学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对数据稀缺雷达应用中多目标检测跟踪难题,PiVoT通过联合推断目标多方面信息,无需外部聚类或检测器,利用变分推断创新实现快速抗杂波跟踪,实验证明其在多方面性能出色,优于现有贝叶斯跟踪器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14839 2026-07-17 cs.CV 版本更新 57%

MapAnything: Evaluating Monocular Metric Depth Models for 3D Urban Asset Localization

MapAnything: 评估单目度量深度模型用于3D城市资产定位

Miriam Louise Carnot, Jonas Kunze, Erik Quinten Fastermann, Eric Peukert, André Ludwig, Bogdan Franczyk

机构 * ScaDS.AI (University of Leipzig)(ScaDS.AI(莱比锡大学)) University of Leipzig(莱比锡大学) Kühne Logistics University(库赫内物流大学) Wrocław University of Economics(沃拉夫经济大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出MapAnything框架,通过单目图像自动映射城市物体和事件,利用度量深度估计模型计算物体坐标,验证其在复杂城市环境中的精度,展示其在交通标志和道路损坏等实际应用中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08068 2026-07-17 cs.CV 版本更新 57%

Simulating Automotive Radar with Lidar and Camera Inputs

利用激光雷达和相机输入模拟汽车雷达

Peili Song, Dezhen Song, Yifan Yang, Enfan Lan, Jingtai Liu

机构 * Institute of Robotics and Automatic Information System, Nankai University(机器人与自动信息系统研究所,南开大学) Tianjin Key Laboratory of Intelligent Robotics(天津智能机器人重点实验室) TBI center, Nankai University(南开大学TBI中心) Department of Robotics, Mohamed Bin Zayed University of Artificial Intelligence (MBZUAI)(人工智能 Mohamed Bin Zayed 大学机器人系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究利用相机图像、激光雷达点云和自身速度模拟汽车雷达信号的方法,基于DIS-Net和RSS-Net两个神经网络,经实验验证能生成高保真信号,用其增强数据训练的目标检测网络性能更优,助力基于雷达的自动驾驶研发。

Comments Accepted by 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13405 2026-07-16 cs.RO 新提交 57%

WNOJ-LIO: A White-Noise-on-Jerk Motion-Prior EKF for High-Dynamic LiDAR-IMU Fusion

WNOJ-LIO:一种用于高动态激光雷达-惯性测量单元融合的基于加加速度白噪声运动先验的扩展卡尔曼滤波器

Junning Lyu, Qizhi Guo, Xia Ning, Tao Song, Shaoming He

机构 * School of Aerospace Engineering, Beijing Institute of Technology(北京理工大学宇航学院)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 研究高动态驾驶下激光雷达-IMU融合问题,提出基于加加速度白噪声运动先验的扩展卡尔曼滤波器框架WNOJ-LIO,通过解耦先验预测状态、视IMU为高频测量源,经仿真和实际实验验证,提升了相关性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19108 2026-07-16 cs.RO 版本更新 57%

Understanding Fire Through Thermal Radiation Fields for Mobile Robots

通过热辐射场理解火灾以实现移动机器人安全导航

Anton R. Wagner, Madhan Balaji Rao, Xuesu Xiao, Sören Pirk

机构 * Department of Computer Science, Kiel University(计算机科学系,基尔大学) Department of Computer Science, George Mason University(计算机科学系,乔治·马歇尔大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出通过实时热辐射场帮助移动机器人安全导航,利用斯特凡-玻尔兹曼定律识别火灾并生成热安全路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02741 2026-07-16 cs.RO 版本更新 57%

PokeNet: Learning Kinematic Models of Articulated Objects from Human Observations

PokeNet: 从人类观察中学习机械结构模型

Anmol Gupta, Weiwei Gu, Omkar Patil, Jun Ki Lee, Nakul Gopalan

机构 * School of Computation and AI, ASU, Tempe(计算与人工智能学院,亚利桑那州立大学) AI Institute, Seoul National University, Seoul, South Korea(首尔国立大学人工智能研究所)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 PokeNet通过单个人类示范学习机械结构模型,无需先验知识,提升关节轴和状态估计精度达27%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09433 2026-07-16 cs.CV eess.IV 版本更新 57%

Efficient LiDAR Reflectance Compression via Scanning Serialization

通过扫描序列化实现高效的激光雷达反射率压缩

Jiahao Zhu, Kang You, Dandan Ding, Zhan Ma

机构 * School of Information Science and Technology, Hangzhou Normal University, Hangzhou, China(信息科学与技术学院,杭州师范大学) School of Electronic Science and Engineering, Nanjing University, Nanjing, China(电子科学与工程学院,南京大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究针对激光雷达反射率在神经压缩方法中未充分探索的问题,提出基于序列化的SerLiC框架。通过扫描序列化转换点云、标记点及采用双并行化方案建模,实验表明其压缩效果优,轻量级版本性能好,对实际应用有吸引力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12959 2026-07-15 cs.CV 新提交 57%

ViCo3D: Empowering LiDAR-based Collaborative 3D Object Detection with Vision Foundation Models

ViCo3D:利用视觉基础模型增强基于激光雷达的协作式3D目标检测

Haojie Ren, Songrui Luo, Lingfeng Wang, Yan Xia, Yao Li, Jing Li, Lu Zhang, Jiajun Deng, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究针对V2X系统中基于激光雷达协作式3D感知的不足,提出ViCo3D框架。通过将点云投影为图像让VFM提取特征,引入融合模块及跨智能体融合策略,实现了先进的3D检测性能,提升了协作增益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10553 2026-07-14 cs.RO 新提交 57%

SLIDER: Sparse History-Guided Aerial Robot Target Search using Sliding Local Maps

SLIDER:使用滑动局部地图的稀疏历史引导空中机器人目标搜索

Xiaolei Hou, Zheng Pan, Hua Lan, Zhenghao Zou, Yinhong Chen, Chenxi Zhu, Yang Lyu, Jinwen Hu, Chunhui Zhao

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 针对空中机器人在大规模未知环境中目标搜索难题,提出SLIDER框架,结合局部滑动地图与稀疏全局历史信息,通过新评估方法、聚类策略及维护拓扑地图实现高效搜索,性能优于现有方法。

Comments Accepted by IEEE Robotics and Automation Letters (RA-L), 2026. https://github.com/Poaos/SLIDER

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10544 2026-07-14 cs.CV 新提交 57%

Physics-inspired Pseudo Anomaly Generation and Prototype Feature Guidance for 3D Anomaly Detection

用于3D异常检测的物理启发式伪异常生成与原型特征引导

Jian Ning, Qin Zou, Linchun Wu, Yuanhao Yue, Kunmo Li, Shoubin Chen, Zhongyuan Wang

机构 * School of Computer Science, Wuhan University(武汉大学计算机科学学院) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳)) School of Information and Software Engineering, East China Jiaotong University(华东交通大学信息工程学院) School of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对3D点云异常检测中真实异常样本稀缺等问题,提出PA3AD框架,采用物理启发式伪异常生成策略及原型特征引导,通过关键创新有效学习分布变化,实验证明其检测性能优于现有方法。

Comments 20 pages; already accepted by Pattern Recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10461 2026-07-14 cs.CV cs.AI 新提交 57%

Annotation-Free Furniture Codes: What They Encode, and How Far They Transfer

无标注家具编码:它们编码了什么以及能转移多远

Benjamin Friedman

机构 * DLR Group(DLR集团)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究能否用源自物体几何形状的自监督令牌取代类别标签和规范姿态约定。通过对FSQ点云自动编码器进行倒角训练,发现编码能恢复多种信息,其旋转内容可由训练目标设置,跨资产库缩放时编码转移情况因类别而异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09947 2026-07-14 cs.RO 新提交 57%

A Numerically-Robust ROS 2 Port of iG-LIO: Diagnosing and Fixing Toolchain-Induced Failures in Incremental GICP LiDAR-Inertial Odometry

iG-LIO的数值稳健ROS 2端口:诊断和修复增量GICP激光雷达惯性里程计中工具链引起的故障

Afonso E. Carvalho, David Portugal, Paulo Peixoto

机构 * Robotics Institute (RI), Carnegie Mellon University (CMU)(卡内基梅隆大学机器人研究所) Institute of Systems and Robotics (ISR), University of Coimbra (UC)(科英布拉大学系统与机器人研究所)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 研究针对iG-LIO的ROS 2端口,诊断并修复由工具链导致的数值故障。通过分析QoS不匹配等问题,采取修正点场解析、添加传感器支持等方法,在多种传感器上验证了改进后的端口,为该端口提供了可引用参考。

Comments 3 pages, 1 figure, 4 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21511 2026-07-14 cs.CV 版本更新 57%

Back to Point: Exploring Point-Language Models for Zero-Shot 3D Anomaly Detection

回到点:探索用于零样本3D异常检测的点语言模型

Kaiqiang Li, Gang Li, Mingle Zhou, Min Li, Delong Han, Jin Wan

机构 * Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Shandong Computer Science Center (National Supercomputer Center in Jinan), Qilu University of Technology (Shandong Academy of Sciences), Jinan, China(计算机功率网络与信息安全重点实验室,教育部,山东计算机科学中心(济南国家超级计算机中心),齐鲁大学(山东科学院),济南,中国) Shandong Provincial Key Laboratory of Computing Power Internet and Service Computing, Shandong Fundamental Research Center for Computer Science, Jinan, China(山东省计算功率互联网与服务计算重点实验室,山东省计算机科学基础研究中心,济南,中国)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出BTP框架,通过结合3D点云和文本嵌入,提升零样本3D异常检测的性能,实验表明其在Real3D-AD和Anomaly-ShapeNet上表现优异。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04404 2026-07-14 cs.RO 57%

A Ground Mobile Robot for Autonomous Terrestrial Laser Scanning-Based Field Phenotyping

一种用于自主地面激光扫描的田间表型分析机器人

Javier Rodriguez-Sanchez, Kyle Johnsen, Changying Li

机构 * School of Electrical and Computer Engineering(电气与计算机工程学院) The University of Georgia(佐治亚大学) Bio-Sensing, Automation and Intelligence Laboratory(生物传感、自动化与智能实验室) Agricultural & Biological Engineering(农业与生物工程) The University of Florida(佛罗里达大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本研究开发了一种自主地面机器人系统,利用高分辨率三维激光扫描仪实现田间表型分析,提高了田间作物生长监测的自动化和准确性。

Comments Submitted to Journal of Field Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09315 2026-07-13 cs.RO 新提交 57%

Robot Trajectron V3: A Probabilistic Shared Control Framework for SE(3) Manipulation

机器人轨迹生成器V3:一种用于SE(3)操作的概率共享控制框架

Pinhao Song, Zhongxi Li, Ze Fu, Federico Ulloa Rios, Renaud Detry

机构 * KU Leuven(鲁汶大学) Flanders Make(法兰德斯制造)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 针对远程操作机器人手臂执行高自由度操作任务的难题(认知要求高、易出错、依赖低带宽接口),提出概率共享控制框架RT-V3,通过贝叶斯推理结合用户意图先验与实时命令估计后验分布,实验证明其在多方面表现出色,优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08391 2026-07-10 cs.RO cs.LG 新提交 57%

On Exploring Input Resolution Scaling For Anytime LiDAR Object Detection

关于探索用于任意时刻激光雷达目标检测的输入分辨率缩放

Ahmet Soyyigit, Shuochao Yao, Heechul Yun

机构 * The National Defense University(国防大学) George Mason University(乔治梅森大学) The University of Kansas(堪萨斯大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 研究为处理激光雷达点云的深度神经网络实现任意时刻计算,提出新方法可多分辨率推理,引入期限感知调度器,内存高效只需单个模型,实验表明优于现有方法,部署在模拟系统可实现无碰撞导航并避免停顿。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03330 2026-07-10 cs.CV 新提交 57%

GrowFields: Compositional 4D Neural Fields for Topology-Changing Plant Growth

GrowFields:用于拓扑变化植物生长的组合式4D神经场

Joaquin Gajardo, Michele Volpi, Marko Mihajlovic, Siyu Tang, Lukas Roth, Sergey Prokudin

机构 * ETH Zürich(苏黎世联邦理工学院) Swiss Data Science Center(瑞士数据科学中心) Martin-Luther-Universität Halle-Wittenberg(马丁-路德-哈雷-维滕贝格大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对从稀疏纵向3D观测量化植物生长动力学的难题,提出GrowFields,将植物分解为器官并对齐到规范坐标系,学习共享神经变形场,在植物器官跟踪中表现优于现有表示。

Comments ECCV 2026 paper (main conference). v2 corrects the vertical guide lines in supplementary Figures 5-7. Project page and code available at https://joaquin-gajardo.github.io/growfields/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05955 2026-07-08 cs.CV cs.AI 新提交 57%

NegROI: Click-Centric Uncertainty-Guided Refinement with Scene-Conditioned Negative Prompts for Robust Interactive 3D Segmentation

NegROI:基于场景条件负提示的以点击为中心的不确定性引导细化用于稳健交互式3D分割

Shuheng Zhang, Feng Wu

机构 * School of Computer Science and Technology, University of Science and Technology of China(中国科学技术大学计算机科学与技术学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究针对交互式3D分割中粗体素分辨率及背景误报问题,提出NegROI框架,结合点击中心多分辨率细化与场景条件负提示,通过不确定性驱动选择性细化、负提示建模及边界感知硬负挖掘,提升点击效率、减少误报并增强跨数据集鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05493 2026-07-08 cs.CV 新提交 57%

Ground3D-LMM: Fine-Grained 3D Point Grounding and Spatial Reasoning with LMM

Ground3D-LMM:基于LMM的细粒度3D点接地与空间推理

Amol Harsh, Zongyan Han, Jean Lahoud, Ye Liu, Rao Muhammad Anwer, Hisham Cholakkal, Salman Khan, Fahad Khan

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) The Hong Kong Polytechnic University(香港理工大学) Linköping University(林雪平大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究3D环境自然语言查询的可操作性问题,提出Ground3D-LMM统一模型,以点云等为输入,支持3D空间对话,能给出基于点的响应和度量数值输出,通过定义新任务、引入数据集验证,为3D对话理解提供强大基线。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏