arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 22015 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 22015 篇

2603.15046 2026-03-17 cs.RO cs.AI 84%

AnoleVLA: Lightweight Vision-Language-Action Model with Deep State Space Models for Mobile Manipulation

AnoleVLA:基于深度状态空间模型的轻量级视觉-语言-动作模型用于移动操作

Yusuke Takagi, Motonari Kambara, Daichi Yashima, Koki Seno, Kento Tokura, Komei Sugiura

机构 * Keio University(keio大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出AnoleVLA,一种轻量级视觉-语言-动作模型,通过深度状态空间模型高效处理多模态序列,提升移动操作的效率与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13756 2026-03-17 cs.RO cs.CV 84%

Exploration-assisted Bottleneck Transition Toward Robust and Data-efficient Deformable Object Manipulation

探索辅助的瓶颈过渡:面向鲁棒且数据高效的可变形物体 manipulation

Yujiro Onishi, Ryo Takizawa, Yoshiyuki Ohmura, Yasuo Kuniyoshi

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出ExBot框架,通过引入瓶颈状态和双动作原语解决可变形物体 manipulation 中的out-of-distribution问题,提升数据效率和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13615 2026-03-17 cs.CV cs.RO 84%

Egocentric World Model for Photorealistic Hand-Object Interaction Synthesis

第一人称世界模型用于逼真手-物体交互合成

Dayou Li, Lulin Liu, Bangya Liu, Shijie Zhou, Jiu Feng, Ziqi Lu, Minghui Zheng, Chenyu You, Zhiwen Fan

机构 * Texas A&M University(德克萨斯A&M大学) University of Minnesota(明尼苏达大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) University of California, Los Angeles(加州大学洛杉矶分校) University of Texas at Austin(得克萨斯大学奥斯汀分校) Amazon(亚马逊) State University of New York at Stony Brook(纽约州立大学石溪分校)

专题命中 机器人操作 :world model(title,abstract);embodied AI(abstract);分类 cs.RO、cs.CV

AI总结 本文提出EgoHOI模型,通过动作信号模拟物理一致的交互,克服了高速头部运动、严重遮挡和高自由度手部运动带来的挑战,实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10373 2026-03-12 cs.RO cs.AI 84%

Few-Shot Adaptation to Non-Stationary Environments via Latent Trend Embedding for Robotics

通过潜在趋势嵌入实现非平稳环境下的少样本适应

Yasuyuki Fujii, Emika Kameda, Hiroki Fukada, Yoshiki Mori, Tadashi Matsuo, Nobutaka Shimada

机构 * College of Information Science and Engineering, Ritsumeikan University(立命馆大学信息科学与工程学院) Production & Technology Department, NIPPN CORPORATION(NIPPN公司生产与技术部门) University of Osaka(大阪大学) National Institute of Technology, Ichinoseki College(国立Ichinoseki学院)

专题命中 机器人操作 :robotics(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种基于潜在趋势ID的少样本适应框架,通过估计低维环境状态实现非平稳环境下的适应,无需修改模型参数,具有可扩展性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06658 2026-03-12 cs.RO cs.AI 84%

Self-Improving Loops for Visual Robotic Planning

自改进循环用于视觉机器人规划

Calvin Luo, Zilai Zeng, Mingxi Jia, Yilun Du, Chen Sun

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 SILVR通过自生成轨迹迭代更新视频模型,实现视觉机器人任务的持续改进,无需人类演示或奖励函数。

Comments ICLR 2026. Project Page: https://diffusion-supervision.github.io/silvr/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09121 2026-03-11 cs.RO cs.AI 84%

DexHiL: A Human-in-the-Loop Framework for Vision-Language-Action Model Post-Training in Dexterous Manipulation

DexHiL: 一种用于灵巧操作中视觉-语言-动作模型后训练的人机协同框架

Yifan Han, Zhongxi Chen, Yuxuan Zhao, Congsheng Xu, Yanming Shao, Yichuan Peng, Yao Mu, Wenzhao Lian

机构 * CASIA(中国科学院自动化研究所) SJTU(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 DexHiL是一种用于灵巧操作中视觉-语言-动作模型后训练的人机协同框架,通过干预意识的数据采样策略和轻量级远程操作界面,显著提升了模型在不同任务中的成功率。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03960 2026-03-05 cs.RO cs.CV 84%

Structural Action Transformer for 3D Dexterous Manipulation

结构动作变换器用于3D灵巧操作

Xiaohan Lei, Min Wang, Bohong Weng, Wengang Zhou, Houqiang Li

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发智能感知与认知国家重点实验室,中国科学技术大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(人工智能研究院,合肥综合性国家科学中心)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出结构动作变换器,通过结构化视角解决高自由度机械手的跨身体技能转移问题,实现更高效的灵巧操作。

Comments Accepted by CVPR

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02511 2026-03-04 cs.RO cs.AI 84%

Learning Object-Centric Spatial Reasoning for Sequential Manipulation in Cluttered Environments

在杂乱环境中学习对象导向的空间推理用于序列操作

Chrisantus Eze, Ryan C Julian, Christopher Crick

机构 * Oklahoma State University(俄克拉荷马州立大学) Google DeepMind(谷歌DeepMind)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本研究提出Unveiler框架,通过解耦高层空间推理与低层动作执行,提升在密集杂乱环境中检索目标的效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21684 2026-02-26 cs.RO cs.LG 84%

Primary-Fine Decoupling for Action Generation in Robotic Imitation

动作生成中的主-细分离

Xiaohan Lei, Min Wang, Wengang Zhou, Xingyu Lu, Houqiang Li

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发智能感知与认知国家重点实验室,中国科学技术大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(人工智能研究院,合肥综合性国家科学中心)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.LG

AI总结 PF-DAG通过两阶段框架实现动作生成中的主-细分离,提升机器人模仿学习的多模态建模与闭环控制性能。

Comments The Fourteenth International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05662 2026-02-25 cs.RO cs.CV 84%

DeLTa: Demonstration and Language-Guided Novel Transparent Object Manipulation

DeLTa: 人机交互与语言引导的新透明物体操控演示

Taeyeop Lee, Gyuree Kang, Bowen Wen, Youngho Kim, Seunghyeok Back, In So Kweon, David Hyunchul Shim, Kuk-Jin Yoon

机构 * KAIST(韩国科学技术院) NVIDIA(英伟达) KIMM(韩国智能媒体实验室)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 DeLTa通过整合深度估计、6D姿态估计和视觉-语言规划,实现基于自然语言指令的精确长周期透明物体操控,无需额外训练或类别先验。

Comments Project page: https://sites.google.com/view/DeLTa25/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05275 2026-02-24 cs.RO cs.LG 84%

TwinVLA: Data-Efficient Bimanual Manipulation with Twin Single-Arm Vision-Language-Action Models

TwinVLA: 通过双单臂视觉-语言-动作模型实现数据高效的双臂操作

Hokyun Im, Euijin Jeong, Andrey Kolobov, Jianlong Fu, Youngwoon Lee

机构 * Department of Artificial Intelligence, Yonsei University(人工智能系,延世大学) Microsoft Research(微软研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 TwinVLA通过模块化组合预训练的单臂视觉-语言-动作模型,实现了高效双臂操作,无需额外双臂数据训练。

Comments Accepted to ICLR 2026 (Poster). Project webpage : https://jellyho.github.io/TwinVLA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17921 2026-02-23 cs.RO cs.LG 84%

Latent Diffeomorphic Co-Design of End-Effectors for Deformable and Fragile Object Manipulation

隐式 diffeomorphic 共设计末端执行器用于可变形和易碎物体 manipulation

Kei Ikemura, Yifei Dong, Florian T. Pokorny

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO、cs.LG

AI总结 本文提出了一种隐式 diffeomorphic 共设计框架,联合优化末端执行器形态和控制策略,以提升可变形和易碎物体 manipulation 的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17101 2026-02-20 cs.RO cs.CV 84%

Benchmarking the Effects of Object Pose Estimation and Reconstruction on Robotic Grasping Success

评估物体位姿估计与重建对机器人抓取成功率的影响

Varun Burde, Pavel Burget, Torsten Sattler

机构 * Faculty of Electrical Engineering, Czech Technical University in Prague(捷克技术大学布拉格电子工程系) Czech Institute of Informatics, Robotics and Cybernetics(捷克信息学、机器人学与自动化研究所)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出基于物理的基准测试,评估三维重建质量对机器人抓取成功率的影响,揭示位姿误差与空间误差对抓取性能的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09013 2026-02-13 cs.RO cs.CV 84%

Dexterous Manipulation Policies from RGB Human Videos via 3D Hand-Object Trajectory Reconstruction

通过3D手-物体轨迹重建从RGB人类视频中学习灵巧操作策略

Hongyi Chen, Tony Dong, Tiancheng Wu, Liquan Wang, Yash Jangir, Yaru Niu, Yufei Ye, Homanga Bharadhwaj, Zackory Erickson, Jeffrey Ichnowski

机构 * Carnegie Mellon University(卡内基梅隆大学) Georgia Institute of Technology(佐治亚理工学院) Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 VIDEOMANIP通过3D手-物体轨迹重建从RGB视频直接学习灵巧操作策略,实现无需设备的高效训练和高成功率抓取

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09851 2026-02-10 cs.RO cs.CV 84%

Simultaneous Tactile-Visual Perception for Learning Multimodal Robot Manipulation

同时触觉-视觉感知用于学习多模态机器人操作

Yuyang Li, Yinghan Chen, Zihang Zhao, Puhao Li, Tengyu Liu, Siyuan Huang, Yixin Zhu

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) School of Psychological and Cognitive Sciences, Peking University(北京大学心理与认知科学学院) Beijing Key Lab of Behavior and Mental Health, Peking University(北京大学行为与心理健康北京市重点实验室) Beijing Institute for General Artificial Intelligence(北京一般人工智能研究院) State Key Lab for General Artificial Intelligence(一般人工智能国家重点实验室) Embodied Intelligence Lab, PKU-Wuhan Institute for Artificial Intelligence(具身智能实验室,北京大学武汉人工智能研究院) Department of Computer Science and Technology, University of Cambridge(剑桥大学计算机科学与技术系)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 TacThru-UMI通过结合同时触觉-视觉感知与现代学习框架,实现了高精度多模态机器人操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03547 2026-02-04 cs.RO cs.CV 84%

AffordanceGrasp-R1:Leveraging Reasoning-Based Affordance Segmentation with Reinforcement Learning for Robotic Grasping

affordanceGrasp-R1: 利用基于推理的 affordance 分割与强化学习进行机器人抓取

Dingyi Zhou, Mu He, Zhuowei Fang, Xiangtong Yao, Yinlong Liu, Alois Knoll, Hu Cao

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 AffordanceGrasp-R1 通过结合推理和强化学习,提升机器人抓取任务中的推理能力和空间定位,实验表明其在基准和现实场景中均表现优异。

Comments Preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09101 2026-01-27 cs.RO cs.AI 84%

Masked Generative Policy for Robotic Control

遮蔽生成策略用于机器人控制

Lipeng Zhuang, Shiyu Fan, Florent P. Audonnet, Yingdong Ru, Edmond S. L. Ho, Gerardo Aragon Camarasa, Paul Henderson

机构 * University of Glasgow(格拉斯哥大学)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 MGP通过并行生成和动态细化技术,实现了在复杂非马尔可夫任务中高效可靠的机器人控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13809 2026-01-22 cs.RO cs.AI 84%

DroneVLA: VLA based Aerial Manipulation

DroneVLA:基于VLA的空中操控

Fawad Mehboob, Monijesu James, Amir Habel, Jeffrin Sam, Miguel Altamirano Cabrera, Dzmitry Tsetserukou

机构 * Skoltech(斯克里普金科技大学)

专题命中 机器人操作 :manipulation(title,abstract);navigation(abstract);分类 cs.RO、cs.AI

AI总结 DroneVLA通过结合VLA模型和定制无人机,实现基于自然语言指令的空中物体抓取与递送,展示了在定位和导航中的高精度表现。

Comments This paper has been accepted for publication at LBR of HRI 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05836 2026-01-12 cs.RO cs.AI 84%

Intelligent Singularity Avoidance in UR10 Robotic Arm Path Planning Using Hybrid Fuzzy Logic and Reinforcement Learning

基于混合模糊逻辑与强化学习的UR10机械臂路径规划中智能奇异点规避

Sheng-Kai Chen, Jyh-Horng Wu

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出一种结合模糊逻辑与强化学习的UR10机械臂路径规划方法,通过实时检测和规避奇异点,实现高成功率的路径规划。

Comments Published in TANET 2025 (Paper No. T0404)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01438 2026-01-06 cs.RO cs.AI 84%

Online Estimation and Manipulation of Articulated Objects

在线估计和操控关节化物体

Russell Buchanan, Adrian Röfer, João Moura, Abhinav Valada, Sethu Vijayakumar

机构 * RIPL-Lab, University of Waterloo, Canada(滑铁卢大学) Robot Learning Lab, University of Freiburg, Germany(弗赖堡大学) School of Informatics, University of Edinburgh, UK(爱丁堡大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种结合视觉先验和本体感觉传感的在线估计方法,用于机器人自主操控未知的关节化物体。

Comments This preprint has not undergone peer review or any post-submission improvements or corrections. The Version of Record of this article is published in Autonomous Robots, and is available online at [Link will be updated when available]

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03606 2025-12-29 cs.RO cs.CV 84%

VTAO-BiManip: Masked Visual-Tactile-Action Pre-training with Object Understanding for Bimanual Dexterous Manipulation

VTAO-BiManip: 带物体理解的遮蔽视觉-触觉-动作预训练用于双臂灵巧操作

Zhengnan Sun, Zhaotai Shi, Jiayin Chen, Qingtao Liu, Yu Cui, Qi Ye, Jiming Chen

机构 * College of Control Science and Engineering, Zhejiang University, Hangzhou, 310027, China(浙江大学控制科学与工程学院)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO、cs.CV

AI总结 VTAO-BiManip通过结合视觉-触觉-动作预训练与物体理解,提升双臂灵巧操作的课程强化学习效果,实现超过现有方法20%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09510 2025-12-23 cs.RO cs.CV 84%

ViTA-Seg: Vision Transformer for Amodal Segmentation in Robotics

ViTA-Seg:用于机器人抓取的视觉Transformer

Donato Caramia, Florian T. Pokorny, Giuseppe Triggiani, Denis Ruffino, David Naso, Paolo Roberto Massenio

机构 * Department of Electrical Learning (RPL), KTH Royal Institute of Technology, 114 28, Stockholm, Sweden, (e-mail: )

专题命中 机器人操作 :robotics(title);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 ViTA-Seg是一种用于机器人抓取的视觉Transformer框架,通过双头架构实现高效的无遮挡分割,提升机器人操作的实时性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08629 2025-12-10 cs.AI cs.CV cs.HC 84%

See-Control: A Multimodal Agent Framework for Smartphone Interaction with a Robotic Arm

See-Control: 一种多模态代理框架用于智能手机与机械臂的交互

Haoyu Zhao, Weizhong Ding, Yuhao Yang, Zheng Tian, Linyi Yang, Kun Shao, Jun Wang

机构 * University College London(伦敦大学学院) Imperial College London(伦敦帝国学院) Huawei Noah’s Ark Lab(华为诺亚实验室) ShanghaiTech University(上海科技大学) Southern University of Science(南方科技大学)

专题命中 机器人操作 :robotic(title,abstract);embodied agent(abstract);分类 cs.AI、cs.CV

AI总结 See-Control通过直接与机械臂交互实现智能手机操作,无需ADB或系统后台访问,提供了一个平台无关的多模态代理框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08548 2025-12-10 cs.RO cs.AI 84%

Bridging Scale Discrepancies in Robotic Control via Language-Based Action Representations

通过基于语言的动作表示弥合机器人控制中的尺度差异

Yuchi Zhang, Churui Sun, Shiqi Liang, Diyuan Liu, Chao Ji, Wei-Nan Zhang, Ting Liu

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出基于语言的动作表示方法,通过规范动作以缓解机器人控制中的尺度差异问题,提升操作任务的泛化能力和迁移性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21149 2025-11-27 cs.RO cs.AI 84%

Maglev-Pentabot: Magnetic Levitation System for Non-Contact Manipulation using Deep Reinforcement Learning

磁悬浮系统Maglev-Pentabot:基于深度强化学习的非接触操控

Guoming Huang, Qingyi Zhou, Dianjing Liu, Shuai Zhang, Ming Zhou, Zongfu Yu

机构 * Department of Electrical and Computer Engineering, University of Wisconsin-Madison(电气与计算机工程系,威斯康星大学麦迪逊分校) Flexcompute Department of Electrical Engineering, Stanford University(电气工程系,斯坦福大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 Maglev-Pentabot通过深度强化学习实现克级非接触操控,解决微米尺度操控限制,支持泛化运输任务和更大重量物体操控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14135 2025-11-11 cs.RO cs.AI 84%

Autonomous Robotic Drilling System for Mice Cranial Window Creation

Enduo Zhao, Murilo M. Marinho, Kanako Harada

机构 * Department of Mechanical Engineering, Graduate School of Engineering, The University of Tokyo(东京大学工学部机械工程系) School of Biomedical Engineering, Tsinghua University(清华大学生物医学工程学院) Graduate School of Medicine, the University of Tokyo(东京大学医学系) Department of Electrical and Electronic Engineering, the University of Manchester(曼彻斯特大学电子与电气工程系) Center for Disease Biology and Integrative Medicine, Graduate School of Medicine, The University of Tokyo(东京大学医学系疾病生物学与整合医学中心)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI

Comments 14 pages, 11 figures, accepted on T-ASE 2025

Journal ref IEEE Transactions on Automation Science and Engineering 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23763 2025-11-04 cs.RO cs.CL cs.CV 84%

RoboOmni: Proactive Robot Manipulation in Omni-modal Context

Siyin Wang, Jinlan Fu, Feihong Liu, Xinzhe He, Huangxuan Wu, Junhao Shi, Kexin Huang, Zhaoye Fei, Jingjing Gong, Zuxuan Wu, Yu-Gang Jiang, See-Kiong Ng, Tat-Seng Chua, Xipeng Qiu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) National University of Singapore(新加坡国立大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19816 2025-10-31 cs.RO cs.CV 84%

CronusVLA: Towards Efficient and Robust Manipulation via Multi-Frame Vision-Language-Action Modeling

Hao Li, Shuai Yang, Yilun Chen, Xinyi Chen, Xiaoda Yang, Yang Tian, Hanqing Wang, Tai Wang, Dahua Lin, Feng Zhao, Jiangmiao Pang

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

Comments 39 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20774 2025-10-29 cs.RO cs.AI cs.HC 84%

FieldGen: From Teleoperated Pre-Manipulation Trajectories to Field-Guided Data Generation

Wenhao Wang, Kehe Ye, Xinyu Zhou, Tianxing Chen, Cao Min, Qiaoming Zhu, Xiaokang Yang, Ping Luo, Yongjian Shen, Yang Yang, Maoqing Yao, Yao Mu

机构 * MoE Key Lab of Artificial Intelligence, AI Institute, SJTU(人工智能基础理论实验室,人工智能学院,上海交通大学) AgiBot HKU(香港大学) Lumina Group(Lumina集团) Shanghai AI Laboratory(上海人工智能实验室) School of Computer Science and Technology, Soochow University(计算机科学与技术学院,苏州大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

Comments Webpage: https://fieldgen.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07975 2025-10-10 cs.RO cs.AI 84%

Executable Analytic Concepts as the Missing Link Between VLM Insight and Precise Manipulation

Mingyang Sun, Jiude Wei, Qichen He, Donglin Wang, Cewu Lu, Jianhua Sun

专题命中 机器人操作 :manipulation(title,abstract);embodied AI(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏