arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-14 至 2026-04-14 共收录 11 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 其他机器人 11 篇

2604.11708 2026-04-14 cs.RO cs.SE cs.SY eess.SY 79%

ACT: Automated CPS Testing for Open-Source Robotic Platforms

ACT:用于开源机器人平台的自动化CPS测试

Aditya A. Krishnan, Donghoon Kim, Hokeun Kim

机构 * Arizona State University(亚利桑那州立大学) Arkansas State University(阿肯色州立大学)

专题命中 其他机器人 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出ACT框架,通过自动化持续测试开源CPS软件与机器人平台,解决多模块开发中测试不足的问题,并通过案例验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09612 2026-04-14 cs.AI cs.HC 79%

Beyond Theory of Mind in Robotics

机器人中的超越心智理论

Malte F. Jung

专题命中 其他机器人 :robotics(title,abstract);分类 cs.AI

AI总结 本文挑战传统心智理论在机器人社交交互中的应用,提出通过实时协调产生社会意义,强调协调策略与主动参与的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11585 2026-04-14 cs.CV cs.RO 73%

GeomPrompt: Geometric Prompt Learning for RGB-D Semantic Segmentation Under Missing and Degraded Depth

GeomPrompt:用于在缺失和退化深度下的RGB-D语义分割的几何提示学习

Krishna Jaganathan, Patricio Vela

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 其他机器人 :robotics(abstract);embodied AI(abstract);分类 cs.RO、cs.CV

AI总结 GeomPrompt通过从RGB生成任务驱动的几何提示,提升RGB-D语义分割在缺失和退化深度下的性能,同时比单目深度估计器更高效。

Comments Accepted to the CVPR 2026 URVIS Workshop. Project page: https://geomprompt.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11572 2026-04-14 cs.RO cs.MM 70%

DA-PTQ: Drift-Aware Post-Training Quantization for Efficient Vision-Language-Action Models

DA-PTQ:面向视觉-语言-动作模型的漂移感知后训练量化

Siyuan Xu, Tianshi Wang, Fengling Li, Lei Zhu, Heng Tao Shen

机构 * Tongji University(同济大学) University of Technology Sydney(悉尼科技大学)

专题命中 其他机器人 :embodied AI(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出DA-PTQ,通过跨空间表示补偿和运动驱动混合精度分配,解决视觉-语言-动作模型中因量化扰动导致的轨迹漂移问题,实现低比特下的高效部署。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09886 2026-04-14 cs.CV cs.AI cs.LG cs.MM eess.IV 67%

Not Your Stereo-Typical Estimator: Combining Vision and Language for Volume Perception

非典型立体视觉估计器:结合视觉与语言进行体积感知

Gautham Vinod, Bruce Coburn, Siddeshwar Raghavan, Fengqing Zhu

机构 * Purdue University(普渡大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文提出融合立体视觉隐式3D线索与自然语言显式先验知识的方法,通过多模态表示提升体积估计精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11373 2026-04-14 cs.RO cs.AI 62%

Minimal Embodiment Enables Efficient Learning of Number Concepts in Robot

最小的具身化能有效学习数字概念的机器人

Zhegong Shangguan, Alessandro Di Nuovo, Angelo Cangelosi

机构 * Cognitive Robotics Lab, Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系认知机器人实验室) Smart Interactive Technologies (SIT) Research Laboratory, Department of Computing, Sheffield Hallam University(谢菲尔德哈勒姆大学计算系智能交互技术(SIT)研究实验室)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文研究了通过机器人与Franka Panda机械臂的自然交互,利用神经网络模型进行序列计数,证明最小具身化能提高学习效率并产生生物合理的表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10772 2026-04-14 cs.CV 57%

HOG-Layout: Hierarchical 3D Scene Generation, Optimization and Editing via Vision-Language Models

HOG-Layout:通过视觉-语言模型实现层次化3D场景生成、优化与编辑

Haiyan Jiang, Deyu Zhang, Dongdong Weng, Weitao Song, Henry Been-Lirn Duh

机构 * The Hong Kong Polytechnic University(香港理工大学) Beijing Institute of Technology(北京理工大学)

专题命中 其他机器人 :embodied AI(abstract);分类 cs.CV

AI总结 HOG-Layout利用大语言模型和视觉-语言模型实现文本驱动的层次化3D场景生成、优化与实时编辑,通过检索增强生成技术提升语义一致性,结合优化模块增强物理一致性,实现高效场景编辑。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10582 2026-04-14 cs.CV 57%

TAPNext++: What's Next for Tracking Any Point (TAP)?

TAPNext++: 追踪任意点(TAP)的下一步

Sebastian Jung, Artem Zholus, Martin Sundermeyer, Carl Doersch, Ross Goroshin, David Joseph Tan, Sarath Chandar, Rudolph Triebel, Federico Tombari

机构 * Google(谷歌) Google DeepMind(谷歌DeepMind) German Aerospace Center (DLR)(德国航空航天中心) Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工学院) Mila - Quebec AI Institute(米拉-魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) Chandar Research Lab(钱达尔研究实验室) Polytechnique Montréal(蒙特利尔综合理工学院) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席) Technical University Munich (TUM)(慕尼黑工业大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 TAPNext++通过训练长序列和引入重检指标提升追踪性能,在保持低内存计算开销的同时实现更长序列的追踪。

Comments 8 pages, will be publised at CVPR Findings 2026, Website https://tap-next-plus-plus.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21484 2026-04-14 cs.CV 57%

Unified Unsupervised and Sparsely-Supervised 3D Object Detection by Semantic Pseudo-Labeling and Prototype Learning

通过语义伪标签和原型学习实现统一的无监督和稀疏监督3D目标检测

Yushen He, Lei Zhao, Weidong Chen

机构 * Institute of Medical Robotics, Shanghai Jiao Tong University(上海交通大学医疗机器人研究院) Key Laboratory of System Control and Information Processing, Ministry of Education of China(系统控制与信息处理教育部重点实验室)

专题命中 其他机器人 :robotic(abstract);分类 cs.CV

AI总结 本文提出SPL框架,通过语义伪标签和原型学习统一无监督和稀疏监督3D目标检测,生成高质量伪标签并稳定特征学习,实验表明在KITTI和nuScenes数据集上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10057 2026-04-14 cs.RO 57%

Natural Gradient Gaussian Approximation Filter on Lie Groups for Robot State Estimation

在李群上的自然梯度高斯近似滤波器用于机器人状态估计

Tianyi Zhang, Wenhan Cao, Chang Liu, Yao Lyu, Shengbo Eben Li

机构 * School of Vehicle and Mobility, Tsinghua University(清华大学车辆与运载学院) College of Engineering, Peking University(北京大学工学院) College of Artificial Intelligence, Tsinghua University(清华大学人工智能学院) Tsinghua-Efort Joint Research Center for EAI Computation and Perception(清华大学-埃夫特EAI计算与感知联合研究中心)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本文提出在李群上基于自然梯度优化的高斯近似滤波器,用于解决机器人系统在李群流形上状态估计的非线性问题,通过避免局部线性化提高估计精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21488 2026-04-14 cond-mat.soft nlin.PS 50%

Electro-mechanical wrinkling of soft dielectric films bonded to hyperelastic substrates

软电介质薄膜与超弹性基底的机电皱褶

Bin Wu, Linghao Kong, Weiqiu Chen, Davide Riccobelli, Michel Destrade

专题命中 其他机器人 :robotics(abstract)

AI总结 研究通过电场控制软薄膜-基底复合材料的皱褶现象,推导出临界拉伸和电压的解析公式,揭示了机电皱褶的基本机制,为柔性材料设计提供理论指导。

Journal ref Journal of the Mechanics and Physics of Solids, Volume 209, 2026, 106490

详情

展开后加载摘要…

URL PDF HTML 收藏