arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-05-01 至 2026-05-01 共收录 13 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 13 篇

2604.28156 2026-05-01 cs.RO cs.AI cs.LG 82%

FlexiTac: A Low-Cost, Open-Source, Scalable Tactile Sensing Solution for Robotic Systems

FlexiTac:一种低成本、开源、可扩展的触觉传感解决方案,用于机器人系统

Binghao Huang, Yunzhu Li

机构 * Columbia University(哥伦比亚大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 FlexiTac是一种低成本、开源、可扩展的触觉传感模块,通过灵活的传感器垫和紧凑的读取板实现高密度触觉信号采集,支持现代触觉学习流程。

Comments Website: https://flexitac.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27699 2026-05-01 cs.AI 79%

Bridging Values and Behavior: A Hierarchical Framework for Proactive Embodied Agents

连接价值与行为:一种面向主动具身代理的分层框架

Chunhui Zhang, Yuxuan Wang, Aoyang Qin, Yi-Long Lu, Kunlun Wu, Yizhou Wang, Wei Wang

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) School of Computer Science, Peking University(北京大学计算机学院) Tsinghua University(清华大学) Nat’l Eng. Research Center of Visual Technology, Peking University(北京大学视觉技术国家工程研究中心) Institute for AI, Peking University(北京大学人工智能研究院) State Key Laboratory of General Artificial Intelligence, Peking University(通用人工智能国家重点实验室,北京大学)

专题命中 机器人数据与评测 :embodied agent(title,abstract);分类 cs.AI

AI总结 本文提出ValuePlanner框架,通过分层认知架构分离高阶价值调度与低阶行动执行,结合LLM生成符号子目标并用PDDL规划器转化为行动计划,通过反馈机制提升自主性,实验表明其能生成连贯的长期自主行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14602 2026-05-01 cs.RO cs.AI cs.HC 76%

K2MUSE: A human lower-limb multimodal walking dataset spanning task and acquisition variability for rehabilitation robotics

K2MUSE:一种涵盖任务和采集变异性的下肢多模态行走数据集,用于康复机器人

Jiwei Li, Bi Zhang, Xiaowei Tan, Wanxin Chen, Zhaoyuan Liu, Juanjuan Zhang, Weiguang Huo, Jian Huang, Lianqing Liu, Xingang Zhao

机构 * State Key Laboratory of Robotics and Intelligent Systems, Shenyang Institute of Automation, Chinese Academy of Sciences(机器人与智能系统国家重点实验室,沈阳自动化研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) College of Artificial Intelligence, Tianjin Key Laboratory of Intelligent Robotics, Nankai University(人工智能学院,天津智能机器人重点实验室,南开大学) School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(人工智能与自动化学院,华中科技大学)

专题命中 机器人数据与评测 :robotics(title);分类 cs.RO、cs.AI

AI总结 K2MUSE数据集通过多模态数据揭示下肢康复机器人与生物力学信息的关系,为康复机器人开发提供大规模步态样本和数据驱动方法支持。

Comments 34 pages, 30 figures,7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27590 2026-05-01 cs.CV 74%

Fake3DGS: A Benchmark for 3D Manipulation Detection in Neural Rendering

Fake3DGS:3D操控检测在神经渲染中的基准

Davide Di Nucci, Riccardo Catalini, Guido Borghi, Roberto Vezzani

机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学)

专题命中 机器人数据与评测 :manipulation(title);分类 cs.CV

AI总结 本文提出Fake3DGS基准,用于评估3D内容的真实性,通过3D高斯点散布场景和渲染视图,展示现有2D检测器在区分原始与3D操控图像上的不足,并引入3D-aware方法提升识别性能。

Comments Accepted at ICPR 2026. Code and data: https://github.com/iot-unimore/Fake3DGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27578 2026-05-01 cs.CV 70%

World2Minecraft: Occupancy-Driven Simulated Scenes Construction

World2Minecraft: 基于占用率的模拟场景构建

Lechao Zhang, Haoran Xu, Jingyu Gong, Xuhong Wang, Yuan Xie, Xin Tan

机构 * School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院)

专题命中 机器人数据与评测 :embodied AI(abstract);navigation(abstract);分类 cs.CV

AI总结 本文提出World2Minecraft,通过3D语义占用率预测将现实场景转换为结构化的Minecraft环境,提升模拟场景的质量与灵活性,通过定制化数据集MinecraftOcc验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27106 2026-05-01 cs.CV cs.AI cs.LG cs.RO 70%

Reconstruction by Generation: 3D Multi-Object Scene Reconstruction from Sparse Observations

通过生成进行重建:从稀疏观测中进行3D多物体场景重建

Andrii Zadaianchuk, Leonardo Barcellona, Lennard Schuenemann, Christian Gumbsch, Zehao Wang, Muhammad Zubair Irshad, Fabien Despinoy, Rahaf Aljundi, Stratis Gavves, Sergey Zakharov

机构 * University of Amsterdam(阿姆斯特丹大学) Toyota Research Institute(丰田研究中心)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出RecGen框架,通过生成方法估计物体和部分形状及其姿态,有效处理遮挡和部分可见性,实现复杂场景的高精度重建。

Comments Website: https://reconstruction-by-generation.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.28179 2026-05-01 cs.CV 57%

Stop Holding Your Breath: CT-Informed Gaussian Splatting for Dynamic Bronchoscopy

停止屏息:基于CT的高斯点云法用于动态支气管镜

Andrea Dunn Beltran, Daniel Rho, Aarav Mehta, Xinqi Xiong, Raúl San José Estépar, Ron Alterovitz, Marc Niethammer, Roni Sengupta

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Harvard Medical School(哈佛医学院) University of California, San Diego(加州大学圣地亚哥分校)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 本文提出利用患者特定的呼吸模型消除屏息协议需求,通过配对呼气吸气CT扫描减少呼吸运动,实现连续的变形感知重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11897 2026-05-01 cs.CR cs.AI 57%

Agentic AI for Cybersecurity: A Meta-Cognitive Architecture for Governable Autonomy

面向网络安全的代理AI:一种用于可控自主性的元认知架构

Andrei Kojukhov, Arkady Bovshover

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 本文提出一种基于概率的代理框架,通过元认知机制协调多个代理,提升网络安全决策的鲁棒性和准确性,减少误报并增强适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13052 2026-05-01 cs.RO 57%

BOW: Bayesian Optimization over Windows for Motion Planning in Complex Environments

BOW:基于窗口的贝叶斯优化用于复杂环境中的运动规划

Sourav Raxit, Abdullah Al Redwan Newaz, Paulo Padrao, Jose Fuentes, Leonardo Bobadilla

机构 * Department of Computer Science, University of New Orleans(新奥尔良大学计算机科学系) School of Computing and Information Sciences, Florida International University(佛罗里达国际大学计算与信息科学学院) Providence College, Department of Mathematics & Computer Science(普罗维登斯学院数学与计算机科学系)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 BOW Planner通过约束贝叶斯优化高效采样控制输入,解决复杂环境中机器人运动规划中的动力学约束问题,提升计算效率和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17792 2026-05-01 cs.AI cs.LO cs.SE 57%

Accelerating Policy Synthesis in Large-Scale MDPs via Hierarchical Adaptive Refinement

通过分层自适应细化加速大规模马尔可夫决策过程的策略合成

Alexandros Evangelidis, Gricel Vázquez, Simos Gerasimou

机构 * University of York(约克大学) Cyprus University of Technology(塞浦路斯技术大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 本文提出通过动态细化马尔可夫决策过程并迭代选择最脆弱区域来加速大规模MDP的策略合成,证明合成策略在标准假设下近优,实验证明在100万状态的MDP中相比PRISM提速达2倍。

Comments Accepted for publication in Proceedings of the ACM on Software Engineering, FSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27445 2026-05-01 cs.CV 57%

Context as Prior: Bayesian-Inspired Intent Inference for Non-Speaking Agents with a Household Cat Testbed

上下文作为先验:一种基于贝叶斯的意图推断方法用于非说话智能体的家用猫测试平台

Wenqian Zhang, Zehao Wang

机构 * University of California, Riverside(加州大学河滨分校)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.CV

AI总结 本文提出CatSignal框架,通过将空间上下文作为先验约束和行为观测作为证据,实现多模态意图推断,提升非说话智能体的意图识别精度。

Comments Accepted to the CVPR 2026 Animal Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26988 2026-05-01 cs.RO 57%

Robot Planning and Situation Handling with Active Perception

具备主动感知的机器人规划与情境处理

Austine Oloo, Zainab Altaweel, Yohei Hayamizu, Peiqi Liu, Yan Ding, Saeid Amiri, Hao Yang, Andy Kaminski, Chad Esselink, Chris Paxton, Xiaohan Zhang, Shiqi Zhang

机构 * SUNY Binghamton(纽约州立大学布法罗分校) CMU(卡内基梅隆大学) Ford Research(福特研究) Agility Robotics(敏捷机器人)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 本文提出VAP-TAMP框架,通过主动感知和情境评估提升机器人在动态环境中执行任务的能力,结合场景图进行任务与运动规划,通过仿真和移动机械臂平台验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12844 2026-05-01 cs.CV 57%

GuideDog: A Real-World Egocentric Multimodal Dataset for Blind and Low-Vision Accessibility-Aware Guidance

GuideDog: 一种用于视障和低视力者无障碍引导的现实世界单人视角多模态数据集

Junhyeok Kim, Jaewoo Park, Junhee Park, Sangeyl Lee, Jiwan Chung, Jisung Kim, Ji Hoon Joung, Youngjae Yu

机构 * Yonsei University(延世大学) LG AI Research(LG AI研究所) Euler Robotics(Euler机器人) Seoul National University(首尔国立大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 本文提出GuideDog数据集,包含22K图像描述对,用于提升视障者导航能力,通过人机协同标注提升数据质量,并展示深度感知评估基准,揭示当前多模态大语言模型在深度感知方面的挑战。

Comments ACL 2026 Main. Project page: https://jun297.github.io/GuideDog/

详情

展开后加载摘要…

URL PDF HTML 收藏