arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-12 至 2026-08-12 共收录 4 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 人机交互与遥操作 4 篇

2601.15069 2026-08-12 cs.RO 版本更新 65%

Influence of Operator Expertise on Robot Supervision and Intervention

操作者专业水平对机器人监督与干预的影响

Yanran Jiang, Pavan Sikka, Leimin Tian, Dana Kuliic, Cecile Paris

机构 * Data 61, CSIRO, Australia(数据61,CSIRO,澳大利亚) Faculty of Engineering, Monash University, Australia(工程学院,墨尔本大学,澳大利亚)

专题命中 人机交互与遥操作 :robotics(abstract,comments);分类 cs.RO

AI总结 本研究探讨不同专业水平的操作者在监督远程机器人时的干预行为差异,通过用户研究揭示不同专业水平对机器人监督任务的影响。

Comments Accepted at the Australasian Conference on Robotics and Automation (ACRA 2025)

Journal ref Australasian Conference on Robotics and Automation (ACRA), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11051 2026-08-12 cs.CV 新提交 57%

HUI360: A 360° Egocentric Dataset and Baselines for Human-Robot Interaction Anticipation

HUI360:用于人机交互预测的360°第一视角数据集及基准模型

Raphael Lorenzo-Louis, Fabio Amadio, Bertrand Luvison, Serena Ivaldi

机构 * Inria(法国国家信息与自动化研究所) CNRS(法国国家科学研究中心) Loria(洛林计算机科学与应用实验室) HUCEBOT Université Paris-Saclay(巴黎-萨克雷大学) CEA(法国原子能和替代能源委员会) List

专题命中 人机交互与遥操作 :embodied agent(abstract);分类 cs.CV

AI总结 该研究推出最大野外人机交互预测数据集HUI360及基准模型,含100万条标注,还发布SSUP-HRI的600万条标注,提供自动标注流水线,实现跨数据集评估,推动人机交互预测研究。

Journal ref 2026 IEEE International Conference on Automatic Face and Gesture Recognition (FG)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10367 2026-08-12 cs.RO cs.HC 新提交 57%

A Neural Network Based Teleoperation for Remote Controlled Vehicles

基于神经网络的遥控车辆遥操作

Ning Ding, Azim Eskandarian

机构 * Virginia Polytechnic Institute and State University(弗吉尼亚理工大学) College of Engineering, Virginia Commonwealth University(弗吉尼亚联邦大学工程学院)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.RO

AI总结 针对车辆遥操作的通信延迟与环境干扰问题,提出集成WV与RBFN的单向框架,经仿真与硬件在环验证,其鲁棒性与效率优于PID等控制器,适配车辆边缘计算。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00945 2026-08-12 cs.HC 版本更新 50%

Sighted by Default: Addressing Implicit Vision Assumptions in Real-Time VLM Assistance for BLV Users

默认以视觉为中心:解决面向盲人和低视力(BLV)用户的实时视觉语言模型(VLM)辅助中的隐含视觉假设问题

Yi Zhao, Siqi Wang, Qiqun Geng, Erxin Yu, Jing Li

专题命中 人机交互与遥操作 :navigation(abstract)

AI总结 针对现有面向BLV用户的实时VLM辅助工具存在的以视觉为中心的默认偏见问题,提出VIA-Agent模型,其在保持与Doubao相当成功率的同时,缩短了任务时间并减少了对话轮次,提升了用户信任度。

Comments Accepted to UIST 2026

详情

展开后加载摘要…

URL PDF HTML 收藏