arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-31 至 2026-03-31 共收录 143 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 31 篇

2603.28333 2026-03-31 cs.CV cs.AI 62%

Integrating Multimodal Large Language Model Knowledge into Amodal Completion

将多模态大语言模型知识整合到无模态补全中

Heecheol Yun, Eunho Yang

机构 * KAIST(韩国科学技术院) AITRICS

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 本文提出AmodalCG框架,利用多模态大语言模型知识指导无模态补全,通过评估遮挡程度选择性调用MLLM指导,结合视觉生成模型迭代优化补全结果,实验表明优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27533 2026-03-31 cs.CV cs.AI 62%

Demo-Pose: Depth-Monocular Modality Fusion For Object Pose Estimation

Demo-Pose: 深度-单目模态融合用于物体姿态估计

Rachit Agarwal, Abhishek Joshi, Sathish Chalasani, Woo Jin Kim

机构 * Samsung Electronics Suwon, Republic of Korea(三星电子水原,韩国)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 本文提出Demo-Pose,通过新颖的多模态融合策略融合单目语义特征与基于深度的图卷积表示,提升物体姿态估计的几何推理能力,在REAL275数据集上优于现有方法。

Comments Accepted at ICASSP 2026, 5 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27441 2026-03-31 cs.CV cs.AI 62%

Evaluating Large and Lightweight Vision Models for Irregular Component Segmentation in E-Waste Disassembly

评估大型和轻量级视觉模型在电子废弃物拆解中不规则组件分割的应用

Xinyao Zhang, Chang Liu, Xiao Liang, Minghui Zheng, Sara Behdad

机构 * Florida State University(佛罗里达州立大学) Texas A&M University(德克萨斯农工大学) University of Florida(佛罗里达大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.AI、cs.CV

AI总结 本文通过比较SAM2和YOLOv8模型,评估了模型架构和规模对分割性能的影响,发现YOLOv8在精度和边界精度上优于SAM2,但SAM2在表示多样物体结构上更灵活。

Comments Accepted at ASME MSEC2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22950 2026-03-31 cs.CV cs.RO 62%

RobotSeg: A Model and Dataset for Segmenting Robots in Image and Video

RobotSeg: 一种用于图像和视频中分割机器人的模型和数据集

Haiyang Mei, Qiming Huang, Hai Ci, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show Lab)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出RobotSeg模型和数据集,解决机器人分割的挑战,通过结构增强的记忆关联器、机器人提示生成器和标签高效训练策略,实现结构感知、自动化的高效分割。

Comments CVPR 2026. Project page: https://github.com/showlab/RobotSeg

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17817 2026-03-31 cs.CV cs.RO 62%

Learning Underwater Active Perception in Simulation

在模拟中学习水下主动感知

Alexandre Cardaillac, Donald G. Dansereau

机构 * Australian Centre For Robotics(澳大利亚机器人中心) School of Aerospace, Mechanical and Mechatronic Engineering(航空航天、机械与机电工程学院) University of Sydney(悉尼大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出一种高效方法,通过多层感知机预测图像质量,以在不同水况下获取高质量资产图像,提升了视觉覆盖和图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28429 2026-03-31 cs.AR cs.AI 57%

AceleradorSNN: A Neuromorphic Cognitive System Integrating Spiking Neural Networks and DynamicImage Signal Processing on FPGA

AceleradorSNN:一种集成脉冲神经网络和动态图像信号处理的类脑认知系统

Daniel Gutierrez, Ruben Martinez, Leyre Arnedo, Antonio Cuesta, Soukaina El Hamry

机构 * Intigia R\&D Department Alicante, Spain

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 为实现自主系统中的高速低延迟高效目标检测,提出AceleradorSNN系统,整合脉冲神经网络与动态图像信号处理,通过FPGA实现实时流式图像处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28224 2026-03-31 cs.CV 57%

Ghost-FWL: A Large-Scale Full-Waveform LiDAR Dataset for Ghost Detection and Removal

Ghost-FWL: 一种大规模全波形激光雷达数据集用于鬼影检测与去除

Kazuma Ikeda, Ryosei Hara, Rokuto Nagata, Ozora Sako. Zihao Ding, Takahiro Kado, Ibuki Fujioka, Taro Beppu, Mariko Isogawa, Kentaro Yoshioka

机构 * Keio University(庆应义塾大学) Sony Semiconductor Solutions(索尼半导体解决方案)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出Ghost-FWL数据集,用于解决移动激光雷达中鬼影点的检测与去除问题,通过全波形激光雷达数据提升3D映射和定位精度,实验表明其在SLAM和目标检测任务中效果显著。

Comments Accepted to CVPR 2026 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28092 2026-03-31 cs.LG 57%

InkDrop: Invisible Backdoor Attacks Against Dataset Condensation

InkDrop: 针对数据集压缩的不可见后门攻击

He Yang, Dongyi Lv, Song Ma, Wei Xi, Zhi Wang, Hanlin Gu, Yajie Wang

机构 * IEEE Publication Technology Group(IEEE出版技术组)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 本文提出InkDrop,一种针对数据集压缩的隐蔽后门攻击方法,通过利用模型决策边界附近的不确定性,实现对压缩数据集的高效且隐蔽的恶意操控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24257 2026-03-31 cs.CV 57%

Memory-Augmented Vision-Language Agents for Persistent and Semantically Consistent Object Captioning

具有记忆增强的视觉-语言代理用于持久且语义一致的对象描述

Tommaso Galliena, Stefano Rosa, Tommaso Apicella, Pietro Morerio, Alessio Del Bue, Lorenzo Natale

机构 * Italian Institute of Technology, Genoa, Italy(意大利理工学院,热那亚,意大利) University of Genoa, Genoa, Italy(热那亚大学,热那亚,意大利)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.CV

AI总结 本文提出一种统一的记忆增强视觉-语言代理,通过单一自回归框架同时处理数据关联、对象描述和探索策略,提升持久且语义一致的对象描述能力。

Comments 24 pages, 7 figures, 7 tables (including Supplementary Materials)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15109 2026-03-31 cs.SI cs.AI cs.CY cs.HC cs.MA 57%

An Agentic Operationalization of DISARM for FIMI Investigation on Social Media

针对FIMI调查的社会媒体的代理操作化DISARM

Kevin Tseng, Juan Carlos Toledano, Bart De Clerck, Yuliia Dukach, Phil Tinn

机构 * Center of Research Acquisition National Institute of Cyber Security Taipei City, Taiwan Department of Mathematics Royal Military Academy Brussels, Belgium Research Division OpenMinds Ltd. Kyiv, Ukraine Department of Sustainable Communication Technologies SINTEF Oslo, Norway (Corresponding Author)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 本文提出一种基于代理的DISARM操作化框架,用于社会媒体上的FIMI调查。通过整合通用代理AI组件,实现对社交媒体数据中操纵性行为的识别和映射,提升分析效率和可解释性。

Comments This paper was originally presented at the International Conference on Military Communication and Information Systems (ICMCIS), organized by the Information Systems Technology (IST) Scientific and Technical Committee, IST-224-RSY---the ICMCIS, held in Bath, United Kingdom, 12-13 May 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20770 2026-03-31 cs.CV 57%

OccuFly: A 3D Vision Benchmark for Semantic Scene Completion from the Aerial Perspective

OccuFly:一种用于从空中视角进行语义场景补全的3D视觉基准

Markus Gross, Sai B. Matha, Aya Fahmy, Rui Song, Daniel Cremers, Henri Meess

机构 * Fraunhofer Institute IVI(弗劳恩霍夫交通与基础设施系统研究所) TU Munich(慕尼黑工业大学) MCML(慕尼黑机器学习中心) UCLA(加州大学洛杉矶分校)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出OccuFly基准,通过无LiDAR相机数据生成框架,提供21类语义的20000+样本,评估视觉模型在空中场景中的局限性。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27534 2026-03-31 cs.RO 57%

S3KF: Spherical State-Space Kalman Filtering for Panoramic 3D Multi-Object Tracking

S3KF:基于旋转激光雷达和四鱼眼相机的全景三维多目标跟踪框架

Zhongyuan Liu, Shaonan Yu, Jianping Li, Pengfei Wan, Xinhang Xu, Pengfei Wang, Maggie Y. Gao, Lihua Xie

机构 * CertaintyX School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院) ST Engineering(新科工程) School of Civil and Environmental Engineering, Nanyang Technological University(南洋理工大学土木与环境工程学院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出S3KF框架,利用旋转激光雷达和四鱼眼相机实现全景三维多目标跟踪,通过球面状态表示和扩展球面卡尔曼滤波提升跟踪精度与实时性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10652 2026-03-31 cs.CV cs.CR 57%

TriDF: Evaluating Perception, Detection, and Hallucination for Interpretable DeepFake Detection

TriDF:评估可解释深度伪造检测的感知、检测和幻觉

Jian-Yu Jiang-Lin, Kang-Yang Huang, Ling Zou, Ling Lo, Sheng-Ping Yang, Yu-Wen Tseng, Kun-Hsiang Lin, Chia-Ling Chen, Yu-Ting Ta, Yan-Tsung Wang, Po-Ching Chen, Hongxia Xie, Hong-Han Shuai, Wen-Huang Cheng

机构 * National Taiwan University(国立台湾大学) National Yang Ming Chiao Tung University(国立阳明交通大学) Jilin University(吉林大学) VinUniversity

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 TriDF提出一个全面的可解释深度伪造检测基准,评估模型感知、检测和幻觉能力,揭示三者间的相互作用,为构建可信系统提供基础。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28191 2026-03-31 cs.CL 50%

DongYuan: An LLM-Based Framework for Integrative Chinese and Western Medicine Spleen-Stomach Disorders Diagnosis

东元:一种基于大语言模型的整合中西医脾胃疾病诊断框架

Hua Li, Yingying Li, Xiaobin Feng, Xinyi Fu, Lifeng Dong, Qingfeng Yang, Yanzhe Chen, Xiaoju Feng, Zhidong Cao, Jianbin Guo, Yanru Du

机构 * Beijing Wenge Technology Co., Ltd.(北京文歌科技有限公司) Hebei Provincial Hospital of Traditional Chinese Medicine(河北省中医院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Tianjin University(天津大学)

专题命中 机器人数据与评测 :navigation(abstract)

AI总结 本文提出东元框架,通过构建三个中西医脾胃疾病数据集,开发核心诊断LLM和咨询导航模型,建立评估基准,显著提升中西医脾胃疾病诊断性能。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他机器人 9 篇

2508.00947 2026-03-31 cs.RO cs.DC cs.NI 83%

Service Discovery-Based Hybrid Network Middleware for Efficient Communication in Distributed Robotic Systems

基于服务发现的混合网络中间件用于分布式机器人系统中的高效通信

Shiyao Sang, Yinggang Ling

机构 * Huaiyin Institute of Technology(淮阴工学院) Chery Automobile Co., Ltd.(奇瑞汽车股份有限公司)

专题命中 其他机器人 :robotic(title,abstract);robotics(abstract);分类 cs.RO

AI总结 本文提出RIMAOS2C中间件,通过多级服务发现组播支持多种通信模式,优化数据传输效率并减少延迟不确定性,提升自动驾驶系统通信性能。

Comments 8 pages, 8 figures, accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28690 2026-03-31 cs.RO cs.CE 79%

Vision-Based Robotic Disassembly Combined with Real-Time MFA Data Acquisition

基于视觉的机器人拆解结合实时MFA数据采集

Federico Zocco, Maria Pozzi, Monica Malvezzi

机构 * Department of Information Engineering and Mathematics, University of Siena(锡耶纳大学信息工程与数学系)

专题命中 其他机器人 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出利用边缘设备实时检测PC组件,实现机器人拆解与材料流分析数据采集,提升关键原材料供应安全。

Comments Submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28674 2026-03-31 cs.RO 57%

Serialized Red-Green-Gray: Quicker Heuristic Validation of Edges in Dynamic Roadmap Graphs

序列化红绿灰:动态道路图中边的快速启发式验证

Yulie Arad, Stav Ashur, Marta Markowicz, James D. Motes, Marco Morales, Nancy M. Amato

机构 * Siebel School of Computing and Data Science, University of Illinois(伊利诺伊大学西贝尔计算与数据科学学院) Department of Computer Science, Instituto Tecnológico Autónomo de México (ITAM)(墨西哥自治技术学院计算机科学系)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本文提出Red-Green-Gray框架,通过保守几何近似快速分类道路图边,结合序列化技术提升GPU加速效率,实验证明其在动态环境中显著提升验证速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21682 2026-03-31 cs.HC 50%

RESPOND: Responsive Engagement Strategy for Predictive Orchestration and Dialogue

RESPOND: 用于预测编排和对话的响应式参与策略

Meng-Chen Lee, Costas Panay, Javier Hernandez, Sean Andrist, Dan Bohus, Anatoly Churikov, Andrew D. Wilson

专题命中 其他机器人 :robotic(abstract)

AI总结 RESPOND通过引入及时的反馈通道和主动的发言声明,使对话更流畅自然,支持根据社交期望调整对话表现。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02698 2026-03-31 cond-mat.soft cond-mat.mtrl-sci 50%

Adaptive hydrogels with spatiotemporal stiffening using pH-modulating enzymes

具有pH调节酶的自适应水凝胶通过时空刚性化

Natascha Gray, Zoe Grämiger, André R. Studart, Rafael Libanori

专题命中 其他机器人 :robotics(abstract)

AI总结 研究通过pH调节酶驱动的水凝胶实现自适应机械响应,揭示化学波与机械波的耦合机制,展示材料在局部刺激下的自适应刚性增强。

Comments revised manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12580 2026-03-31 cond-mat.soft cond-mat.other 50%

Anonymous leadership and stochastic resonance in collectives of self-propelled robots

匿名领导者与集体自驱动机器人中的随机共振

Manuel Dizenhaus, Franco De Simone, German A. Patterson

专题命中 其他机器人 :robotic(abstract)

AI总结 研究匿名领导者对自驱动机器人集体的影响,发现其在中间扰动水平下诱导随机共振,通过Kilobot实验和模拟验证领导者反转周期与系统无扰动平均驻留时间匹配时产生共振。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27677 2026-03-31 eess.SY cs.SY 50%

Safety-Constrained Optimal Control for Unknown System Dynamics

未知系统动态下的安全约束最优控制

Panagiotis Kounatidis, Andreas A. Malikopoulos

专题命中 其他机器人 :robotic(abstract)

AI总结 本文提出了解决连续最优控制问题的框架,当真实系统动态通过不完美的模型近似时。通过将Pontryagin极小原理应用于基于模型的哈密顿函数,引入了捕捉模型与真实系统偏差的惩罚项,并在弱凸性假设下推导出模型策略与真实系统最优策略一致的条件,通过真实机器人平台验证了该框架。

Comments Submitted to CDC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27580 2026-03-31 eess.SY cs.SY math-ph math.DS math.MP 50%

Structure-Preserving Learning of Nonholonomic Dynamics

保持结构的非完整约束动力学习

Thomas Beckers, Anthony Bloch, Leonardo Colombo

专题命中 其他机器人 :robotics(abstract)

AI总结 本文提出一种保持结构的高斯过程框架,用于学习非完整动力学,通过非完整矩阵核保证学习的动力学满足约束条件,并通过数值模拟验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27574 2026-03-31 physics.optics 50%

Single-Step Grayscale Lithography of Multi-Depth Mie Void Metasurfaces

单步灰度光刻制备多深度Mie空洞超材料

Oren Goldberg, Noa Mazurski, Uriel Levy

专题命中 其他机器人 :robotics(abstract)

AI总结 本文通过电子束灰度光刻实现多深度Mie空洞超材料的局部精确深度控制,利用不同曝光剂量调节PMMA厚度,生成可调谐的光子结构,实现可见光范围内的高精度色彩生成。

Comments 6 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏