arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-21 至 2026-04-21 共收录 29 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 29 篇

2604.16788 2026-04-21 cs.RO 88%

LongBench: Evaluating Robotic Manipulation Policies on Real-World Long-Horizon Tasks

LongBench:在真实世界长时域任务上评估机械臂策略

Xueyao Chen, Jingkai Jia, Tong Yang, Yibo Fu, Wei Li, Wenqiang Zhang

机构 * Fudan University(复旦大学)

专题命中 机器人数据与评测 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 LongBench通过1000多个真实任务评估长时域机械臂策略,区分全观测和依赖上下文的两种模式,揭示执行鲁棒性和上下文推理的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16484 2026-04-21 cs.CV cs.AI 84%

DexWorldModel: Causal Latent World Modeling towards Automated Learning of Embodied Tasks

DexWorldModel:基于因果潜在世界的建模以实现具身任务的自动化学习

Yueci Deng, Guiliang Liu, Kui Jia

机构 * DexForce AI

专题命中 机器人数据与评测 :world model(title,abstract);manipulation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出CLWM模型,通过分离交互语义与视觉噪声提升领域泛化能力,采用双状态测试时训练机制和推测异步推理方法,实现高效长周期任务处理,并通过EmbodiChain框架提升策略鲁棒性,实验表明其在复杂双臂仿真和物理机器人零样本迁移中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18271 2026-04-21 cs.RO 83%

EmbodiedLGR: Integrating Lightweight Graph Representation and Retrieval for Semantic-Spatial Memory in Robotic Agents

EmbodiedLGR:整合轻量级图表示与检索用于机器人代理中的语义-空间记忆

Paolo Riva, Leonardo Gargani, Matteo Frosi, Matteo Matteucci

机构 * Department of Electronics, Information, and Bioengineering (DEIB), Politecnico di Milano(电子、信息与生物工程系(DEIB),米兰理工大学)

专题命中 机器人数据与评测 :robotic(title);robotics(abstract);embodied agent(abstract);分类 cs.RO

AI总结 本文提出EmbodiedLGR-Agent,通过参数高效VLM构建语义-空间记忆,实现高效的环境记忆表示与检索,实验证明其在推理和查询时间上达到SOTA,且在实际部署中表现出良好的实用性。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17513 2026-04-21 cs.RO 83%

FLASH: Fast Learning via GPU-Accelerated Simulation for High-Fidelity Deformable Manipulation in Minutes

FLASH:通过GPU加速模拟实现高效的高保真变形操纵

Siyuan Luo, Bingyang Zhou, Chong Zhang, Xin Liu, Zhenhao Huang, Gang Yang, Zhengtao Han, Xiaotian Hu, Eric Yang, Rymon Yu, Ziqiu Zeng, Fan Shi

机构 * NUS Human-Centered Robotic Lab(国立新加坡大学人本机器人实验室) ETH(苏黎世联邦理工学院) ShanghaiTech University(上海科技大学) Independent Researcher(独立研究者) Gradient

专题命中 机器人数据与评测 :manipulation(title,abstract);robot learning(abstract);分类 cs.RO

AI总结 FLASH通过GPU加速模拟实现高效变形操纵,利用NCP求解器在单个RTX 5090上支持30 FPS处理300万自由度,基于合成数据训练的策略实现零样本仿真到现实转移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23224 2026-04-21 cs.RO 83%

AeroScene: Progressive Scene Synthesis for Aerial Robotics

AeroScene:用于空域机器人领域的渐进式场景合成

Nghia Vu, Tuong Do, Dzung Tran, Binh X. Nguyen, Hoan Nguyen, Erman Tjiputra, Quang D. Tran, Hai-Nguyen Nguyen, Anh Nguyen

机构 * University of Liverpool, UK(英国利物浦大学) AIOZ Ltd., Singapore(新加坡AIOZ有限公司) National Tsing Hua University, Taiwan(台湾国立清华大学) RMIT University, Vietnam Campus(越南RMIT大学校园) University of Information Technology, VNUHCM, Vietnam(越南VNUHCM大学信息科技学院)

专题命中 机器人数据与评测 :robotics(title,abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出AeroScene,一种用于空域机器人领域的渐进式3D场景合成模型,通过分层扩散模型实现全局布局与局部细节的推理,生成物理合理且语义一致的场景,提升导航、着陆等任务性能。

Comments 8 pages. Accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17019 2026-04-21 cs.AI 81%

Mini-BEHAVIOR-Gran: Revealing U-Shaped Effects of Instruction Granularity on Language-Guided Embodied Agents

Mini-BEHAVIOR-Gran:揭示指令粒度对语言引导的具身智能体的影响

Sukai Huang, Chenyuan Zhang, Fucai Ke, Zhixi Cai, Gholamreza Haffari, Lizhen Qu, Hamid Rezatofighi

机构 * Faculty of Information Technology, Monash University(信息技术学院,莫纳什大学)

专题命中 机器人数据与评测 :embodied agent(title);embodied AI(abstract);分类 cs.AI;robotics(comments)

AI总结 本文提出Mini-BEHAVIOR-Gran基准,通过多级指令变体研究指令粒度对具身智能体性能的影响,发现粒度与性能呈非单调U型关系,粗粒度性能反弹与浅层 grounding 有关。

Comments 23 pages, Keywords: Language Grounding, Language Granularity, Instruction Following Agent, Width-based Planning Research Area: Multimodality and Language Grounding to Vision, Robotics and Beyond Research Area Keywords: vision language navigation, multimodality, neurosymbolic approaches

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12676 2026-04-21 cs.CV cs.AI 81%

BridgeEQA: Virtual Embodied Agents for Real Bridge Inspections

BridgeEQA:用于真实桥梁检查的虚拟具身代理

Subin Varghese, Joshua Gao, Asad Ur Rahman, Vedhus Hoskere

机构 * University of Houston(德克萨斯大学休斯顿分校)

专题命中 机器人数据与评测 :embodied agent(title,abstract);分类 cs.AI、cs.CV

AI总结 本文提出BridgeEQA基准,通过200个真实桥梁场景和2200个开放词汇问题对,评估具身记忆问答能力,引入Image Citation Relevance指标,并提出EMVR模型提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18835 2026-04-21 cs.RO 79%

A Real-World Grasping-in-Clutter Performance Evaluation Benchmark for Robotic Food Waste Sorting

一种用于机器人食品废物分拣的现实世界抓取-杂乱环境性能评估基准

Moniesha Thilakarathna, Xing Wang, Min Wang, David Hinwood, Shuangzhe Liu, Damith Herath

机构 * Faculty of Science and Technology, University of Canberra(科学与技术学院,堪培拉大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出GRAB基准,通过1750次抓取尝试评估不同夹具在杂乱环境中的抓取性能,揭示物体质量是影响抓取表现的主要因素。

Comments 26 pages, 13 Figures, 4 Tables. Revised manuscript with a clearer state-of-the-art discussion, reorganized methodology, and updated figures and content

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21282 2026-04-21 cs.RO 79%

EgoWalk: A Multimodal Dataset for Robot Navigation in the Wild

EgoWalk:一种用于野外机器人导航的多模态数据集

Timur Akhtyamov, Mohamad Al Mdfaa, Javier Antonio Ramirez Benavides, Arthur Nigmatzyanov, Sergey Bakulin, German Devchich, Denis Fatykhov, Diego Ruiz Salinas, Alexander Mazurov, Kristina Zipa, Malik Mohrat, Pavel Kolesnik, Ivan Sosin, Gonzalo Ferrer

机构 * Skolkovo Institute of Science and Technology(斯克尔科沃科学与技术研究所) Sber Robotics Center(Sber机器人中心)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出EgoWalk数据集,包含50小时人类在多样化环境中的导航数据,提供多模态数据及自动化子集生成流程,展示其在机器人导航中的应用价值。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16336 2026-04-21 cs.HC cs.AI cs.MA 79%

Distributed Human Identity: AI-Enabled Multi-Existence Through Cognitive Replication and Robotic Embodiments

分布式人类身份:通过认知复制和机器人躯体实现的AI赋能多存在

A S M Touhidul Islam, John Tookey

机构 * Faculty of Design and Creative Technologies, Auckland University of Technology(设计与创意技术学院,奥克兰技术大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.AI

AI总结 本文提出多存在身份框架,通过认知、行为和情感属性的复制,实现AI赋能的多场景存在,突破传统物理躯体限制,提升身份一致性与文化相关性,探讨其在专业、教育、医疗等领域的应用与伦理挑战。

Comments 30 pages, 1 figure, 4 tables. cs.AI under Computer Science category

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19577 2026-04-21 cs.RO 79%

Chasing Ghosts: A Simulation-to-Real Olfactory Navigation Stack with Optional Vision Augmentation

追踪鬼魂:一种模拟到现实的嗅觉导航堆栈,可选视觉增强

Kordel K. France, Ovidiu Daescu, Latifur Khan, Rohith Peddi

机构 * Dept. of Computer Science University of Texas at Dallas Richardson, TX, USA(计算机科学系德克萨斯大学达拉斯分校理查德森市德克萨斯州美国)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出了一种基于无人机的嗅觉导航系统,通过模拟训练和现实部署实现在线气味源定位,无需构建气体分布图或依赖外部定位系统,同时提供可选视觉增强功能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00752 2026-04-21 math.OC cs.RO 79%

Model-free source seeking of exponentially convergent unicycle: theoretical and robotic experimental results

无模型的指数收敛单轮车源寻找:理论和机器人实验结果

Rohan Palanikumar, Ahmed A. Elgohary, Victoria Grushkovskaya, Sameh A. Eisa

机构 * Department of Aerospace Engineering and Engineering Mechanics(航空航天工程与工程力学系) University of Cincinnati(辛辛那提大学) Department of Mathematics(数学系) University of Klagenfurt(克雷格弗特大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出一种无模型的单轮车源寻找设计,实现指数收敛于高次幂函数极值点,通过理论分析和机器人实验验证了其鲁棒性和实际应用能力。

Journal ref IFAC J. Syst. Control. 35 (2026) 100378

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18236 2026-04-21 cs.RO 78%

COFFAIL: A Dataset of Successful and Anomalous Robot Skill Executions in the Context of Coffee Preparation

COFFAIL:咖啡准备情境中成功与异常机器人技能执行数据集

Alex Mitrevski, Ayush Salunke

机构 * Division of Systems and Control, Chalmers University of Technology(系统与控制系,楚姆勒斯理工大学) Bonn-Rhein-Sieg University of Applied Sciences(波恩-莱茵-西弗大学) Autonomous Systems Group, Bonn-Rhein-Sieg University of Applied Sciences(自主系统组,波恩-莱茵-西弗大学)

专题命中 机器人数据与评测 :robot learning(abstract);manipulation(abstract);robot policy(abstract);分类 cs.RO

AI总结 本文提出COFFAIL数据集,包含厨房环境中机器人成功与异常咖啡制作技能执行数据,用于通过模仿学习训练机器人策略。

Comments Presented as an extended abstract at the 2nd German Robotics Conference (GRC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16886 2026-04-21 cs.RO 77%

Chain Of Interaction Benchmark (COIN): When Reasoning meets Embodied Interaction

交互链基准(COIN):当推理遇见具身交互

Xianhao Wang, Xiaojian Ma, Haozhe Hu, Rongpeng Su, Yutian Cheng, Zhou Ziheng, Hangxin Liu, Lei Liu, Bin Li, Qing Li

机构 * University of Science and Technology of China(中国科学技术大学) Beijing Institute for General Artificial Intelligence (BIGAI)(北京通用人工智能研究院) Xidian University(西安电子科技大学) Shanghai Jiao Tong University(上海交通大学) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 机器人数据与评测 :embodied agent(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 COIN基准通过设计日常场景下的50个交互任务,评估机器人在部分可观测环境下进行因果依赖推理的能力,揭示现有方法在交互推理任务中的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05405 2026-04-21 cs.CV 74%

A VLM-based Method for Visual Anomaly Detection in Robotic Scientific Laboratories

基于VLM的方法用于机器人科学实验室中的视觉异常检测

Shiwei Lin, Chenxu Wang, Xiaozhen Ding, Yi Wang, Boyuan Du, Lei Song, Chenggang Wang, Huaping Liu

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) School of Physics and Electronic Information, Yantai University(烟台大学物理与电子信息学院) School of Computer and Big Data, Fuzhou University(福州大学计算机与大数据学院) Department of Automation, Shanghai Jiao Tong University(上海交通大学自动化系)

专题命中 机器人数据与评测 :robotic(title);分类 cs.CV

AI总结 本文提出基于VLM的视觉推理方法,通过四个逐步信息提示配置实现多级监督,构建了专用视觉基准以评估其在科学流程异常检测中的有效性,实验表明提供更多上下文信息可提升检测准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18205 2026-04-21 cs.CV cs.RO 73%

A Comparative Evaluation of Geometric Accuracy in NeRF and Gaussian Splatting

神经渲染中NeRF与高斯散射几何精度的比较评估

Mikolaj Zielinski, Eryk Vykysaly, Bartlomiej Biesiada, Jan Baturo, Mateusz Capala, Dominik Belter

机构 * Institute of Robotics and Machine Intelligence, Poznan University of Technology(机器人与机器智能研究所,波兹南技术大学)

专题命中 机器人数据与评测 :robotics(abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出评估神经渲染方法几何精度的流程,包含19个多样场景,系统评估重建方法的表面和形状保真度,补充传统视觉指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16408 2026-04-21 cs.RO cs.HC 72%

An Edge-Host-Cloud Architecture for Robot-Agnostic, Caregiver-in-the-Loop Personalized Cognitive Exercise: Multi-Site Deployment in Dementia Care

一种面向机器人无关、陪护人员在环的个性化认知训练的边缘-主机-云架构:在痴呆症护理中的多地点部署

Wenzheng Zhao, Ruth Palan Lopez, Shu Fen Wung, Fengpei Yuan

机构 * Worcester Polytechnic Institute(沃斯特理工大学)

专题命中 机器人数据与评测 :robotics(abstract,comments);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种分布式机器人交互平台,通过整合护理人员知识、边缘智能和机器人代理,实现个性化认知训练支持。平台通过多模态信号融合实现情感感知,并通过边缘服务器实现低延迟、隐私保护的部署。

Comments 21 pages, 6 figures, 10 tables, submitted to IEEE Transactions on Robotics (T-RO)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21545 2026-04-21 cs.RO 70%

UniDomain: Pretraining a Unified PDDL Domain from Real-World Demonstrations for Generalizable Robot Task Planning

UniDomain:从真实世界演示中预训练一个统一的PDDL领域以实现可泛化的机器人任务规划

Haoming Ye, Yunxiao Xiao, Cewu Lu, Panpan Cai

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 UniDomain通过预训练统一的PDDL领域,结合机器人操作演示,实现可泛化的任务规划,实验显示其在零样本情况下任务成功率和计划优化度显著提升。

Comments Accepted at NeurIPS 2025

Journal ref Advances in Neural Information Processing Systems 38 (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18468 2026-04-21 cs.CV cs.AI cs.GR cs.LG 67%

Asset Harvester: Extracting 3D Assets from Autonomous Driving Logs for Simulation

资产收割者:从自动驾驶日志中提取3D资产用于模拟

Tianshi Cao, Jiawei Ren, Yuxuan Zhang, Jaewoo Seo, Jiahui Huang, Shikhar Solanki, Haotian Zhang, Mingfei Guo, Haithem Turki, Muxingzi Li, Yue Zhu, Sipeng Zhang, Zan Gojcic, Sanja Fidler, Kangxue Yin

机构 * NVIDIA

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文提出Asset Harvester,通过图像到3D模型的端到端流程,将稀疏的现实日志中物体观测转换为完整的模拟资产,结合大规模数据整理、几何感知预处理和鲁棒训练方案,解决自动驾驶数据中的稀疏视角等挑战。

Comments NVIDIA white paper. The project page: https://research.nvidia.com/labs/sil/projects/asset-harvester/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18463 2026-04-21 cs.AI cs.LG cs.RO 67%

Using large language models for embodied planning introduces systematic safety risks

使用大型语言模型进行具身规划引入了系统性的安全风险

Tao Zhang, Kaixian Qu, Zhibin Li, Jiajun Wu, Marco Hutter, Manling Li, Fan Shi

机构 * ETH Zurich(苏黎世联邦理工学院) University College London(伦敦大学学院) Stanford University(斯坦福大学) Northwestern University(西北大学) National University of Singapore(新加坡国立大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 研究评估了大型语言模型在机器人规划中的安全性,发现即使规划能力高,安全风险仍显著存在,揭示了规划能力与安全意识之间的乘法关系。

Comments Project page: https://despite-safety.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07826 2026-04-21 cs.CV cs.LG cs.RO 67%

R3D2: Realistic 3D Asset Insertion via Diffusion for Autonomous Driving Simulation

R3D2:通过扩散实现自动驾驶模拟中的真实3D资产插入

William Ljungbergh, Bernardo Taveira, Wenzhao Zheng, Adam Tonderski, Chensheng Peng, Fredrik Kahl, Christoffer Petersson, Michael Felsberg, Kurt Keutzer, Masayoshi Tomizuka, Wei Zhan

机构 * Zenseact Linköping University(林哈尔大学) Chalmers University(查尔姆斯理工大学) UC Berkeley(加州大学伯克利分校)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 R3D2是一种轻量级单步扩散模型,用于在现有场景中实时生成真实3D资产,通过训练学习真实集成,提升自动驾驶模拟的真实性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23786 2026-04-21 cs.CV cs.RO 62%

Bridging the Ex-Vivo to In-Vivo Gap: Synthetic Priors for Monocular Depth Estimation in Specular Surgical Environments

弥合体外到体内差距:用于镜面外科环境单目深度估计的合成先验

Ankan Aich, Emma D. Ryan, Kris Moe, Isaac Schmale, Li-Xing Man, Yangming Lee

机构 * RoCAL, Rochester Institute of Technology(罗切斯特理工学院RoCAL实验室) Department of Otolaryngology Head and Neck Surgery, University of Rochester Medical Center(罗切斯特大学医学中心耳鼻喉科与头颈外科部门) University of Washington, Department of Otolaryngology–Head and Neck Surgery(华盛顿大学耳鼻喉科与头颈外科部门)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出合成先验用于改善外科环境中单目深度估计,通过DV-LORA适应深度anything v2架构,在SCARED数据集上达到新状态,同时引入ROCAL-T 90数据集验证模型在真实临床场景中的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19685 2026-04-21 cs.CV cs.AI 62%

Generating Attribution Reports for Manipulated Facial Images: A Dataset and Baseline

生成篡改面部图像的归因报告:一个数据集和基线

Jingchun Lian, Lingyu Liu, Yaxiong Wang, Yujiao Wu, Lianwei Wu, Li Zhu, Zhedong Zheng

机构 * Xi’an Jiaotong University(西安交通大学) Hefei University of Technology(合肥工业大学) CSIRO(澳大利亚联邦科学与工业研究组织) Northwestern Polytechnical University(西北工业大学) University of Macau(澳门大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出多模态篡改追踪数据集和 ForgeryTalker 框架,通过联合定位篡改区域和生成自然语言解释,提升面部伪造检测的语义理解能力。

Comments Accepted to ACL 2026 (Main Conference). This version includes camera-ready revisions and updated experimental results

Journal ref Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (ACL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08336 2026-04-21 cs.LG cs.RO 62%

RAYEN: Imposition of Hard Convex Constraints on Neural Networks

RAYEN:在神经网络中施加硬凸约束

Jesus Tordesillas, Victor Klemm, Jonathan P. How, Marco Hutter

机构 * Institute for Research in Technology, ICAI School of Engineering, Comillas Pontifical University(技术研究 institute,ICAI 工程学院,Comillas 大学) Aerospace Controls Laboratory, Massachusetts Institute of Technology(航空航天控制实验室,麻省理工学院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.LG

AI总结 RAYEN通过高效方法在神经网络输出或潜在变量中施加硬凸约束,保证训练和测试时的约束满足,支持多种约束类型,显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17231 2026-04-21 cs.CV cs.RO 62%

Fringe Projection Based Vision Pipeline for Autonomous Hard Drive Disassembly

基于条纹投影的自主硬盘拆解视觉流水线

Badrinath Balasubramaniam, Vignesh Suresh, Benjamin Metcalf, Beiwen Li

机构 * School of Electrical and Computer Engineering, University of Georgia(佐治亚大学电气与计算机工程学院) Alcon Research Laboratories(阿康研究实验室) School of Environmental, Civil, Agricultural and Mechanical Engineering, University of Georgia(佐治亚大学环境、土木、农业和机械工程学院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出基于条纹投影的视觉流水线,通过3D传感和实例分割网络实现硬盘拆解的精准定位与识别,提升拆解效率与鲁棒性。

Comments 20 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16582 2026-04-21 cs.CV cs.AI 62%

Camo-M3FD: A New Benchmark Dataset for Cross-Spectral Camouflaged Pedestrian Detection

Camo-M3FD:一种新的跨光谱伪装行人检测基准数据集

Henry O. Velesaca, Andrea Mero, Guillermo A. Castillo, Angel D. Sappa

机构 * ESPOL Polytechnic University(ESPOL理工大学) Computer Vision Center, Universitat Autònoma de Barcelona(巴塞罗那自治大学计算机视觉中心) Software Engineering Department, Research Center for Information and Communication Technologies (CITIC-UGR), University of Granada(格拉纳达大学软件工程系,信息与通信技术研究中心(CITIC-UGR)) Università della Svizzera Italiana(瑞士意大利大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 本文提出Camo-M3FD数据集,用于跨光谱伪装行人检测,通过高精度图像对和标准化评估框架提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16486 2026-04-21 cs.CV cs.LG 62%

Aletheia: Physics-Conditioned Localized Artifact Attention (PhyLAA-X) for End-to-End Generalizable and Robust Deepfake Video Detection

Aletheia: 基于物理条件的局部化瑕疵注意力(PhyLAA-X)用于端到端通用且鲁棒的深度伪造视频检测

Devendra Ghori

机构 * Aletheia Project(Aletheia项目)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV、cs.LG

AI总结 本文提出PhyLAA-X,通过引入物理衍生特征体积提升深度伪造检测的鲁棒性,在多个数据集上均取得显著性能提升。

Comments Code: https://github.com/devghori1264/Aletheia (MIT license). Dataset notes: see Data and Code Availability section

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17065 2026-04-21 cs.CV 57%

BasketHAR: A Multimodal Dataset for Human Activity Recognition and Sport Analysis in Basketball Training Scenarios

BasketHAR:一种用于篮球训练场景中的人体活动识别和运动分析的多模态数据集

Xian Gao, Haoyue Zhang, Zongyun Zhang, Jiacheng Ruan, Ting Liu, Yuzhuo Fu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 本文提出BasketHAR数据集,用于解决现有HAR数据集在体育分析应用中的不足,通过多模态数据包括运动传感器和视频记录,提供先进的HAR任务研究资源。

Comments 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18395 2026-04-21 cs.CR 50%

Capturing Monetarily Exploitable Vulnerability in Smart Contracts via Auditor Knowledge-Learning Fuzzing

通过审计员知识学习模糊化捕捉可货币化利用的漏洞

Bowen Cai, Weiheng Bai, Hangyun Tang, Youshui Lu, Kangjie Lu

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 本文提出FAUDITOR,通过整合审计报告和自学习机制,有效识别智能合约中的可货币化漏洞,发现220个零日漏洞,提升检测效率和覆盖率。

详情

展开后加载摘要…

URL PDF HTML 收藏