arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-16 至 2026-04-16 共收录 2 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 人机交互与遥操作 2 篇

2512.10605 2026-04-16 cs.RO 79%

LEO-RobotAgent: A General-purpose Robotic Agent for Language-driven Embodied Operator

LEO-RobotAgent: 一种通用的基于语言的机器人代理框架

Lihuang Chen, Xiangyu Luo, Jun Meng

机构 * Zhejiang University, Hangzhou 310000, P. R. China(浙江大学,杭州310000,中华人民共和国)

专题命中 人机交互与遥操作 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出LEO-RobotAgent框架,旨在通过语言驱动实现机器人在复杂场景中完成多样化任务,具备强泛化能力、鲁棒性和高效性,降低人机交互门槛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16385 2026-04-16 cs.CV 57%

Adaptive Multi-Scale Channel-Spatial Attention Aggregation Framework for 3D Indoor Semantic Scene Completion Toward Assisting Visually Impaired

自适应多尺度通道-空间注意力聚合框架用于3D室内语义场景补全以协助视障人士

Qi He, XiangXiang Wang, Jingtao Zhang, Yongbin Yu, Hongxiang Chu, Manping Fan, JingYe Cai, Zhenglin Yang

专题命中 人机交互与遥操作 :navigation(abstract);分类 cs.CV

AI总结 本文提出自适应多尺度注意力聚合框架,解决2D到3D特征提升中的噪声扩散和多尺度融合结构不稳定问题,通过通道-空间注意力机制和分层自适应门控策略提升小物体和桌子的识别精度,实验表明在NYUv2基准上mIoU达27.88%。

Comments We need to optimize the experiment, the changes are quite significant

详情

展开后加载摘要…

URL PDF HTML 收藏