arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 476 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 476 篇

2606.15117 2026-06-16 cs.MM cs.AI cs.CV cs.LG cs.SD 新提交 67%

Teacher-Student Structure for Domain Adaptation in Ensemble Audio-Visual Video Deepfake Detection

用于集成视听视频深度伪造检测中领域适应的师生结构

Elham Abolhasani, Maryam Ramezani, Hamid R. Rabiee

机构 * Department of Computer Engineering, Sharif University of Technology(谢里夫理工学院计算机工程系)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 提出EAV-DFD方法,结合师生框架的领域适应机制,提升模型在未见领域上的泛化能力,在三个数据集上AUC分别提升4.09%、17.94%和0.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13515 2026-06-12 cs.CV cs.LG cs.RO 新提交 67%

MaskWAM: Unifying Mask Prompting and Prediction for World-Action Models

MaskWAM:统一掩码提示与预测的世界-动作模型

Hanyang Yu, Haitao Lin, Jingbo Zhang, Wenyao Zhang, Chenghao Gu, Heng Li, Ping Tan

机构 * The Hong Kong University of Science and Technology(香港科技大学) Tencent Robotics X(腾讯机器人X实验室) Tsinghua University(清华大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 提出MaskWAM,通过统一掩码输入与预测的混合Transformer架构,解决世界-动作模型的空间瓶颈,提升策略泛化能力,在LIBERO等任务上显著优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17699 2026-07-21 cs.RO cs.CV 新提交 66%

SLAM in Low-Light Environments: Project Report

低光照环境下的同步定位与地图构建:项目报告

Oleh Basystyi, Anna Stasyshyn, Oleksandr Kosovan, Yaroslav Prytula

机构 * Applied Sciences Faculty, Ukrainian Catholic University(乌克兰天主教大学应用科学学院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.CV;navigation(comments)

AI总结 研究低光照环境下RGB相机的SLAM问题,对六种不同范式的系统在五个序列上进行基准测试,发现仅RGB的SLAM需惯性融合和全局优化才能稳定跟踪,为后续改进提供方向。

Comments Conducted as part of the certification program "Off-Road Visual Navigation: Development and Evaluation of Systems in Challenging Environments'' at the Faculty of Applied Sciences, Ukrainian Catholic University, in collaboration with the UCU UGV Club

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16862 2026-07-21 cs.CV cs.RO 新提交 66%

InLiER: Learning-Free Heterogeneous LiDAR Place Recognition via Intermediate Mixed-Radix Structural Keypoint Tokenization

InLiER:通过中间混合基数结构关键点令牌化实现无学习的异构激光雷达地点识别

Nikolaos Stathoulopoulos, George Nikolakopoulos

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV;robotics(comments)

AI总结 研究针对机器人平台结合多种激光雷达致现有描述符性能下降的问题,提出无学习管道InLiER,通过混合基数令牌ID编码关键点信息,经三个检索阶段处理,在相关数据集和实验中表现出色,优于基于学习的基线。

Comments Accepted for publication in IEEE Robotics and Automation Letters (RA-L). 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05669 2026-07-08 cs.RO cs.LG 新提交 66%

Uncertainty-Aware Velocity Correction for Proprioceptive Vehicle Localization using Evidential Mamba

使用证据曼巴进行本体感知车辆定位的不确定性感知速度校正

Abinav Kalyanasundaram, Karthikeyan Chandra Sekaran, Wolfgang Utschick, Michael Botsch

机构 * AImotion Bavaria, Technische Hochschule Ingolstadt(巴伐利亚AImotion公司,英戈尔施塔特技术应用大学) Technische Universität München(慕尼黑工业大学)

专题命中 机器人数据与评测 :navigation(abstract,comments);分类 cs.RO、cs.LG

AI总结 针对智能车辆在GNSS信号缺失时定位难题,提出EVC-Mamba架构,利用车载传感器数据转化为虚拟速度传感器校正IMU漂移,经曼巴模型捕捉动态、证据深度学习量化不确定性,实现高精度定位且支持实时车载部署。

Comments Accepted at the 2026 International Conference on Indoor Positioning and Indoor Navigation (IPIN 2026), Rome, Italy. 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03553 2026-07-07 cs.CV cs.RO 新提交 66%

iVISION-2DCD: A Long-Term Change Detection Dataset for Large-Scale Outdoor Construction Monitoring

iVISION-2DCD:用于大规模户外建筑监测的长期变化检测数据集

Dayou Mao, Yuchen Lin, Ashkan Ebadi, John Zelek, Alexander Wong, Yuhao Chen

机构 * National Research Council Canada(加拿大国家研究委员会) Vision and Image Processing Research Group, Systems Design Engineering, University of Waterloo(滑铁卢大学系统设计工程系视觉与图像处理研究小组)

专题命中 机器人数据与评测 :robotics(abstract,comments);分类 cs.RO、cs.CV

AI总结 研究从检测建筑工地变化监测施工进度,针对跨视角变化检测算法缺开源基准数据集问题,用LiDAR点云生成iVISION-2DCD数据集,提出合成数据生成等方法,为相关领域带来新挑战。

Comments 11 pages, 7 figures, 1 table. Accepted for publication at the 2026 IEEE International Conference on Robotics and Automation (ICRA 2026). Project page: https://danielmao2019.github.io/iVISION-2DCD-dataset.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14766 2026-06-16 cs.CV cs.AI cs.MA 新提交 66%

XMedFusion: A Knowledge-Guided Multimodal Perception and Reasoning Framework for Autonomous Medical Systems

XMedFusion:面向自主医疗系统的知识引导多模态感知与推理框架

Hamza Riaz, Arham Haroon, Maha Baig, Muhammad Dawood Rizwan, Muhammad Naseer Bajwa, Muhammad Moazam Fraz

机构 * National University of Sciences and Technology (NUST)(巴基斯坦国立科技大学) University of Oxford(牛津大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.AI、cs.CV;robotics(comments)

AI总结 提出XMedFusion模块化AI框架,通过视觉感知、知识图谱构建和检索引导生成等智能体协同,增强放射学报告生成的视觉基础与临床发现捕捉能力,在公共数据集上显著优于基线模型。

Comments Accepted at the 2026 International Conference on Robotics and Automation in Industry (ICRAI)

Journal ref 2026 International Conference on Robotics and Automation in Industry (ICRAI), pp. 1-6, May 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13719 2026-08-17 cs.AI cs.RO 新提交 62%

Coverage Aware Active Evaluation for Failure Discovery with Paired Systems

面向配对系统故障发现的覆盖率感知主动评估

Anjali Parashar, Rachel Luo, Apoorva Sharma, Sushant Veer, Edward Schmerling, Carson Sobolewski, Mingxin Yu, Chuchu Fan, Marco Pavone

机构 * Laboratory of Information & Decision Systems (LIDS), MIT(麻省理工学院信息与决策系统实验室(LIDS)) NVIDIA Research(英伟达研究院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 该研究针对自主系统故障发现难题,提出结合代理评估与残差建模、支持感知互信息目标的自适应方法,在三类任务中发现的故障数是基线的两倍。

Comments 9 main pages followed by Appendix, total 21 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13028 2026-08-14 cs.CV cs.RO 新提交 62%

RGB-D Video Generation for Improving Human-to-Robot Object Handover Prediction

用于改进人机物体交接预测的RGB-D视频生成

Tianyu Sun, Zhoujie Fu, Zihui Gao, Bang Zhang, Guosheng Lin

机构 * Nanyang Technological University(南洋理工大学) College of Computing and Data Science(计算与数据科学学院) Zhejiang University(浙江大学) College of Computer Science and Technology(计算机科学与技术学院) Alibaba Group(阿里巴巴集团)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 针对人机物体交接数据集稀缺及现实-模拟差距问题,提出Hand2Bot数据集与PassGen生成流水线,实现高意图识别准确率与低误触发率,支持机器人稳健零样本迁移与早期意图预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11564 2026-08-13 cs.CV cs.RO 新提交 62%

Repurposing RGB-based Foundation Model for Depth Estimation on Thermal Images Using Hierarchical Supervision

利用分层监督将基于RGB的基础模型重新用于热图像的深度估计

Jie Hong, Tingtian Li, Xuesong Li, Xiao Li

机构 * The University of Hong Kong(香港大学) Commonwealth Scientific and Industrial Research Organisation (CSIRO)(英联邦科学与工业研究组织)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 针对热图像深度估计中RGB基础模型分层表示利用不足的问题,提出RGB-HS框架,通过分层监督和基于图像质量的标记加权对齐,在基准上实现了有竞争力的性能。

Comments Accepted in IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10660 2026-08-12 cs.CV cs.AI 新提交 62%

Cross-View Sequential Visual Localization with Spatio-Temporal Context Modeling for Autonomous Driving

面向自动驾驶的融合时空上下文建模的跨视角序列视觉定位

Jiaping Wang, Shaobo Li, Zhen Wang

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 本研究提出时序上下文增强的跨视角序列视觉定位框架,通过循环跨帧模块聚合历史上下文提升定位精度,在多个公开数据集及实装实验中均取得显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07905 2026-08-11 cs.AI cs.RO 新提交 62%

GraphThink: Graph-Enhanced LLM Thinking for Long-Horizon Embodied Task Planning

GraphThink:用于长视距具身任务规划的图增强大语言模型思维

Chen Li, Sijie Cheng, Yuelin Zhang, Junxi Li, Maozhi Huang, Yang Liu, Wenbing Huang

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Tsinghua University(清华大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.RO、cs.AI

AI总结 GraphThink框架结合任务图与场景图,通过上下文提示、迭代优化、GRPO奖励设计及事件驱动重规划,在ALFRED基准上实现最优性能,具强泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07018 2026-08-10 eess.IV cs.CV cs.LG 新提交 62%

IceHorizon: A Dataset for Horizon Detection in Ice-Covered Maritime Environments and Comparative Evaluation of Detection Methods

IceHorizon:冰盖海域环境中地平线检测的数据集及检测方法的对比评估

Alisa Pesotskaia, Emin Zerman

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV、cs.LG

AI总结 本文构建了IceHorizon数据集,对比评估六种地平线检测算法,发现混合方法准确率最高,且船舶图像检测性能优于无人机图像,相关资源已公开供后续研究使用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04398 2026-08-06 cs.RO cs.AI 新提交 62%

Approximate Multi-Objective Search Under Rulebooks

规则手册下的近似多目标搜索

Omar Muhammetkulyyev, Oren Salzman, Tichakorn Wongpiromsarn

机构 * Iowa State University(爱荷华州立大学) Technion - Israel Institute of Technology(以色列理工学院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 针对机器人规划中规则手册下多目标最优解计算成本高的问题,提出RA*pex算法,结合降维与规则层次处理,大幅提升计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03296 2026-08-05 cs.RO cs.CV 新提交 62%

PLS-Calib: A Partial Least Squares Framework for Event Camera and Odometry Calibration under Ground Motion Constraints

PLS-Calib:一种在地面运动约束下用于事件相机与里程计校准的偏最小二乘框架

Guangyu Li, Xiao Li, Yujie Wu, Changshuo Wang, Prayag Tiwari, Jiang Cai, Fangwen Yu, Mingkun Xu

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 针对地面约束机器人的传感器校准难题,提出PLS-Calib框架,利用PLS回归建模传感器流相关性,结合极性感知事件表示,在合成与真实数据集上验证其校准鲁棒性和精度优于现有最优方法。

Comments 8 pages, 10 figures, 4 tables. Accepted at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03198 2026-08-05 cs.CV cs.RO 新提交 62%

Bridging Online and Offline Handwriting via Differentiable Physical Rendering

通过可微物理渲染连接在线与离线手写文字

Seonmi Park, Seunghyun Shin, Vihaan Misra, Dongmin Shin, Ukcheol Shin, Jean Oh, Hae-Gon Jeon

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 该研究提出统一在线-离线手写生成框架,通过物理画笔模型与可微渲染模块解决两类手写生成范式的缺陷,经实验验证实现了结构与视觉保真度。

Comments Accepted at ECCV 2026, Project page: https://seonmip.github.io/onoff

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02270 2026-08-04 cs.RO cs.AI 新提交 62%

TS-MAMP: A Remanufactured Agricultural Robot Powered by Second-Life EV Components and NMS-Free On-Device Weed Detection

TS-MAMP:基于退役电动汽车部件和无NMS设备端杂草检测的再制造农业机器人

Weijie Shi, Zicheng Xu, Zhenbang Cheng, Haoran Xuan, Mingbo Duan, Gan Ge

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 该研究基于退役电动汽车部件开发了平价再制造农业机器人TS-MAMP,采用无NMS的YOLOv10n检测器实现设备端杂草检测,为小农户提供了低成本AI农业自动化方案。

Comments 6 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01423 2026-08-04 cs.AI cs.GT cs.LG 新提交 62%

Scoring Rules! Statistical and Strategic Alignment for Text Evaluation Metrics

评分规则!文本评估指标的统计对齐与策略对齐

Shengwei Xu, Yuxuan Lu, Yifan Wu, Jason Hartline, Grant Schoenebeck

机构 * University of Michigan(密歇根大学) Peking University(北京大学) Microsoft Research(微软研究院) Northwestern University(西北大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对文本评估指标,提出统计与策略对齐概念及三项测试原则,开发基于互信息的指标设计框架,发现 LLM-as-a-Judge 相关性高但易操纵,新指标鲁棒性强且相关性具竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01402 2026-08-04 cs.RO cs.AI 新提交 62%

Demystifying When and Why VLAs Fail in Contact-Rich Tasks and How to Fix Them

揭秘视觉-语言-动作模型在接触丰富任务中的失效时机、原因及修复方法

Carlota Parés-Morlans, Nils Kuhn, Isabel Liu, Alberta Longhini, Jeannette Bohg

机构 * Stanford University(斯坦福大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 该研究揭示视觉-语言-动作模型在接触丰富操纵任务中的两种失效模式,提出针对性机制整合而成的FACT模型,在5项任务上平均成功率达66%,优于现有基线。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01129 2026-08-04 cs.RO cs.CV 新提交 62%

FeDepth: Federated Learning for Depth Estimation under Robot Heterogeneity

FeDepth:面向机器人异构性的深度估计联邦学习

Ganghyeon Lee, Inha Lee, Junhee Lee, Jeongeon Lee, Sung Whan Yoon, Kyungdon Joo

机构 * Ulsan National Institute of Science and Technology (UNIST)(蔚山科学技术院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 针对机器人感知深度估计中联邦学习因客户端异构性导致性能下降的问题,本文提出FeDepth框架,通过软聚类建模客户端关系,在多架构上提升了联邦学习的鲁棒性。

Comments Accepted at ECCV 2026. Ganghyeon Lee and Inha Lee contributed equally. Kyungdon Joo is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29596 2026-08-03 cs.RO cs.CV 新提交 62%

FibVLA: An Efficient Temporal Vision-Language-Action Model with Fibonacci Sampling

FibVLA:一种采用斐波那契采样的高效时序视觉-语言-动作模型

Li Lin, Wujun Xu, Weiwei Meng, Kaiwen Xia, Kang Hao Cheong, Shuai Wang

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.RO、cs.CV

AI总结 本文提出FibVLA框架,通过对数事后采样和流匹配等技术,解决了视觉-语言-动作模型时序信息捕捉与推理效率的矛盾,提升了动作性能与实时响应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27597 2026-07-31 cs.RO cs.AI cs.SY eess.SY 新提交 62%

A Systems Engineering Framework for Vision-Language-Enabled UAV Triage and Disaster Response

面向视觉语言赋能的无人机分类与灾害响应的系统工程框架

Swapnil Saha, Bhuvan Rajanasiriyur Jagadeesha, Karishma Patnaik, Neelakshi Majumdar

机构 * University of Arkansas(阿肯色大学) University of Michigan-Dearborn(密歇根大学迪尔伯恩分校)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 该研究提出将视觉语言模型(VLMs)作为协同智能体嵌入人-无人机回路的系统工程框架,经评估可降低人因负担、提升AI信任度,推进了高风险灾害响应的人-自主系统协同。

Comments 10 pages, 8 figures. Author accepted manuscript of AIAA Paper 2026-4010, published in the AIAA AVIATION 2026 Forum

Journal ref AIAA AVIATION 2026 Forum, AIAA Paper 2026-4010, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22789 2026-07-28 eess.IV cs.CV cs.RO 新提交 62%

Learning-based Hierarchical Tracheal Anatomy Understanding from Sparse Surgical Demonstration Annotations for Ultrasound Robots

基于稀疏手术演示标注的超声机器人气管解剖结构分层学习理解

Hiu Ching Cheung, Wenchao Yue, Zhengran Han, Mingcong Chen, Guanglin Cao, Hongbin Liu, Hongliang Ren

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 针对气管切开术定位问题,提出结合YOLOv8n与SAM2的学习框架,经混合训练平衡多方面性能,优于U-Net基线,实现高吞吐量,为机器人辅助气管切开术提供标准化自主手术辅助基础,提升安全性与精度。

Comments 17 pages, 8 figures, accepted at the 2026 International Conference on Cyborg and Bionic Systems (2026ICCBS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24249 2026-07-28 cs.CV cs.RO 新提交 62%

SILICA: Repurposing Diffusion Priors for Joint Glass Segmentation and Depth Estimation

SILICA:将扩散先验用于联合玻璃分割和深度估计

Tarun R, Anuj Verma, Laksh Nanwani, Sourav Garg, K. Madhava Krishna

机构 * Robotics Research Center (RRC), IIIT Hyderabad(海得拉巴国际信息技术研究所机器人研究中心)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究透明表面深度估计难题,提出SILICA统一管道,利用文本到图像扩散模型先验联合预测玻璃分割和深度,无需真实世界玻璃深度注释,经实验验证其在不同环境中零样本转移性能出色,优于现有模型。

Comments IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24031 2026-07-28 cs.AI cs.HC cs.RO eess.SP 新提交 62%

A Cyclic Adaptation-Generalization Framework with Uncertainty-Guided Self-Paced Learning for Long-Term Brain-Machine Interfaces

一种用于长期脑机接口的具有不确定性引导自步学习的循环适应-泛化框架

Jiyu Wei, Di Hong, Zhanjie Zhang, Dazhong Rong, Qinming He, Yueming Wang

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Nanhu Brain-Computer Interface Institute(南湖脑机接口研究所)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI

AI总结 针对侵入性脑机接口因神经漂移面临的长期部署挑战,提出UnSPC框架,通过UnSPL机制协同DA和DG,利用噪声鲁棒排序策略挖掘可靠伪标签样本,引入CycAG策略整合DA和DG,经实验验证其有效性和鲁棒性,为长期BMI控制铺路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23669 2026-07-28 cs.CV cs.RO 新提交 62%

RRTrack: Robust and Recoverable Object 6D Pose Tracking for Dynamic Scenes

RRTrack:用于动态场景的鲁棒且可恢复的物体6D姿态跟踪

Junyue Li, Ye Zheng, Yifan Chen, Zhe Sun, Xuelong Li

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究院) College of Future Information Technology, Fudan University(复旦大学未来信息技术学院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 研究针对动态场景中物体6D姿态跟踪难题,提出RRTrack。它采用2D-6D闭环跟踪策略,集成记忆视频对象分割与6D姿态细化,还有双库模板匹配模块。在合成基准和真实世界实验中验证,相比FoundationPose有显著提升,兼具高效与鲁棒性。

Comments 6D Pose Tracking, 10 pages, real-world experiments, training-free

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23565 2026-07-28 cs.RO cs.LG 新提交 62%

Anticipatory Risk-Guided Reinforcement Learning for Safe Flight Through Dynamic Clutter

用于在动态杂波中安全飞行的预期风险引导强化学习

Yuchao Mei, Guohao Zhang, Luxia Ai, Haopeng Chen, Wenbing Tao

机构 * Huazhong University of Science and Technology(华中科技大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 研究在动态杂波中四旋翼安全飞行问题,提出预期风险引导强化学习框架,利用特权模拟器状态构建风险地图,通过非对称架构训练网络自我预测风险,结合轻量级编码器提取线索,实验证明该方法有效提高安全裕度和飞行效率,且能实现模拟到现实的零样本转移。

Comments 8 pages, 7 figures. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22702 2026-07-28 cs.CV cs.LG 新提交 62%

MIME: Multimodal Interactive Motion Encoder

MIME:多模态交互式运动编码器

Addison Zucek, Prerit Gupta, Kamila Kuatova, Aniket Bera

机构 * Purdue University(普渡大学)

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.CV、cs.LG

AI总结 研究针对动画、AR/VR等场景中多人交互的文本-运动表示学习问题,提出多模态交互式运动编码器MIME,通过特定方法捕捉结构并训练,在文本-运动检索任务中表现出色,还能跨数据集支持下游运动生成。

Comments Under review at WACV 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22345 2026-07-27 cs.RO cs.AI 新提交 62%

Teachy Mini: Development and Preliminary Evaluation of a Knowledge-Based Generative Social Robot for Higher Education

Teachy Mini:用于高等教育的基于知识的生成式社交机器人的开发与初步评估

Stephan Vonschallen, Karim Kaufmann, Dominique Oberle, Friederike Eyssel, Theresa Schmiedel

机构 * Institute of Information Systems, Zurich University of Applied Sciences(苏黎世应用科学大学信息系统研究所) Center for Cognitive Interaction Technology, Bielefeld University(比勒费尔德大学认知交互技术中心)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 研究针对生成式社交机器人在高等教育辅导中的风险,基于知识的设计要求开发Teachy Mini系统,经初步评估,该系统在负责任辅导行为及个性化等方面表现更佳,虽在部分方面与对照无显著差异,但显示出基于知识的设计对学习效果有积极作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22325 2026-07-27 cs.CV cs.RO 新提交 62%

Geometric 2D Scene Graph Generation

几何二维场景图生成

Christoph Jahn, Urs Waldmann, Bastian Goldluecke

机构 * Mercedes-Benz AG(梅赛德斯-奔驰股份公司) Department of Computer and Information Science, University of Konstanz(康斯坦茨大学计算机与信息科学系)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 针对消费品生产及机器人装配中部件装配关系表示问题,提出不依赖语义数据、可处理小数据集的方法。利用Faster R-CNN输出经处理生成邻接矩阵,输入基于aGCN架构的暹罗网络表征连接,在玩具模型部件数据集上验证了该方法。

Comments Accepted at the 18th International Conference on Agents and Artificial Intelligence ICAART 2026, Marbella, Spain

Journal ref Jahn, C., Waldmann, U. and Goldluecke, B. (2026). Geometric 2D Scene Graph Generation. In Proceedings of the 18th International Conference on Agents and Artificial Intelligence - ICAART 2026

详情

展开后加载摘要…

URL PDF HTML 收藏