arXivDaily arXiv每日学术速递 周一至周五更新

作者

Pieter Abbeel

Robotics

共收录 415
2601.22074 2026-02-26 cs.RO

mjlab: A Lightweight Framework for GPU-Accelerated Robot Learning

mjlab: 一种轻量级的GPU加速机器人学习框架

Kevin Zakka, Qiayuan Liao, Brent Yi, Louis Le Lay, Koushil Sreenath, Pieter Abbeel

机构 * UC Berkeley(加州大学伯克利分校) Sorbonne University(索邦大学)

AI总结 mjlab是一种轻量级GPU加速机器人学习框架,结合可组合环境和MuJoCo Warp,提供快速安装和直接访问原生数据结构的功能,并附带三种任务的参考实现。

Comments Comments: 11 pages; Code is available at https://github.com/mujocolab/mjlab ; Expanded sensor and domain randomization sections, added references, minor edits

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06949 2026-02-09 cs.RO cs.AI cs.CV cs.LG

DreamDojo: A Generalist Robot World Model from Large-Scale Human Videos

DreamDojo:从大规模人类视频中学习通用机器人世界模型

Shenyuan Gao, William Liang, Kaiyuan Zheng, Ayaan Malik, Seonghyeon Ye, Sihyun Yu, Wei-Cheng Tseng, Yuzhu Dong, Kaichun Mo, Chen-Hsuan Lin, Qianli Ma, Seungjun Nah, Loic Magne, Jiannan Xiang, Yuqi Xie, Ruijie Zheng, Dantong Niu, You Liang Tan, K. R. Zentner, George Kurian, Suneel Indupuru, Pooya Jannaty, Jinwei Gu, Jun Zhang, Jitendra Malik, Pieter Abbeel, Ming-Yu Liu, Yuke Zhu, Joel Jang, Linxi "Jim" Fan

机构 * NVIDIA HKUST(香港科技大学) UC Berkeley(加州大学伯克利分校) Stanford(斯坦福大学) KAIST(韩国科学技术院) UofT(多伦多大学) UCSD(加州大学圣地亚哥分校) UT Austin(德克萨斯大学奥斯汀分校)

AI总结 DreamDojo通过大规模人类视频学习通用机器人世界模型,解决动作标签稀缺问题,实现高精度物理理解和实时交互。

Comments Project page: https://dreamdojo-world.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03002 2026-02-04 cs.RO

RPL: Learning Robust Humanoid Perceptive Locomotion on Challenging Terrains

RPL:在复杂地形上学习鲁棒的人形感知移动

Yuanhang Zhang, Younggyo Seo, Juyue Chen, Yifu Yuan, Koushil Sreenath, Pieter Abbeel, Carmelo Sferrazza, Karen Liu, Rocky Duan, Guanya Shi

AI总结 RPL通过两阶段训练框架在复杂地形上实现稳健的多方向人形移动,结合深度蒸馏和增强技术,提升机器人负载下的移动能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02481 2026-02-03 cs.RO cs.AI

Flow Policy Gradients for Robot Control

用于机器人控制的流匹配策略梯度

Brent Yi, Hongsuk Choi, Himanshu Gaurav Singh, Xiaoyu Huang, Takara E. Truong, Carmelo Sferrazza, Yi Ma, Rocky Duan, Pieter Abbeel, Guanya Shi, Karen Liu, Angjoo Kanazawa

机构 * Amazon FAR(亚马逊Far) UC Berkeley(加州大学伯克利分校) Stanford(斯坦福大学) HKU(香港大学) CMU(卡内基梅隆大学)

AI总结 本文提出了一种基于流匹配的策略梯度方法,用于训练更复杂的机器人控制策略,实现了在四肢运动、人形运动跟踪和操作任务中的成功,并展示了在仿真到现实迁移中的鲁棒性。

Comments Project webpage: https://hongsukchoi.github.io/fpo-control

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12796 2026-01-21 cs.RO

Contact-Aware Neural Dynamics

接触感知神经动力学

Changwei Jing, Jai Krishna Bandi, Jianglong Ye, Yan Duan, Pieter Abbeel, Xiaolong Wang, Sha Yi

机构 * UC San Diego(圣迭戈大学) Amazon FAR (Frontier AI & Robotics)(亚马逊前沿人工智能与机器人实验室)

AI总结 本文提出了一种基于接触信息的神经动力学模型,通过利用现实数据改进仿真到现实的对齐,提升状态预测和策略优化的准确性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03734 2026-01-01 cs.RO cs.CV

OTTER: A Vision-Language-Action Model with Text-Aware Visual Feature Extraction

OTTER: 一种具有文本感知视觉特征提取的视觉-语言-动作模型

Huang Huang, Fangchen Liu, Letian Fu, Tingfan Wu, Mustafa Mukadam, Jitendra Malik, Ken Goldberg, Pieter Abbeel

机构 * University of California, Berkeley(加州大学伯克利分校) Meta AI

AI总结 OTTER通过文本感知的视觉特征提取,提升视觉-语言-动作模型的零样本泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10042 2025-12-12 cs.LG

SEMDICE: Off-policy State Entropy Maximization via Stationary Distribution Correction Estimation

SEMDICE:通过平稳分布校正估计实现的非策略状态熵最大化

Jongmin Lee, Meiqi Sun, Pieter Abbeel

机构 * UC Berkeley(加州大学伯克利分校) Yonsei University(延世大学)

AI总结 SEMDICE通过平稳分布校正估计,从非策略数据集中学习状态熵最大化策略,实现更高效的无监督强化学习预训练。

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01996 2025-12-02 cs.RO cs.AI cs.LG

Learning Sim-to-Real Humanoid Locomotion in 15 Minutes

在15分钟内学习仿真到现实的人形机器人运动控制

Younggyo Seo, Carmelo Sferrazza, Juyue Chen, Guanya Shi, Rocky Duan, Pieter Abbeel

机构 * Amazon FAR (Frontier AI & Robotics)(亚马逊前沿人工智能与机器人研究院)

AI总结 本研究提出了一种基于FastSAC和FastTD3的简单方法,在15分钟内通过单块RTX 4090 GPU实现人形机器人运动控制的快速训练。

Comments Project website: https://younggyo.me/fastsac-humanoid

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20066 2025-11-26 cs.LG

SOMBRL: Scalable and Optimistic Model-Based RL

SOMBRL: 可扩展且乐观的基于模型的强化学习

Bhavya Sukhija, Lenart Treven, Carmelo Sferrazza, Florian Dörfler, Pieter Abbeel, Andreas Krause

AI总结 SOMBRL通过结合乐观性原则和不确定性建模,实现了在非线性动力学中具有亚线性遗憾的可扩展基于模型的强化学习方法,并在多个环境中展示了优越的探索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12155 2025-11-18 cs.LG cs.AI cs.RO

Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning

Younggyo Seo, Pieter Abbeel

机构 * UC Berkeley(伯克利大学)

Comments 18 Pages. Website: https://younggyo.me/cqn-as/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07418 2025-11-11 cs.RO cs.AI cs.CV cs.DC cs.GR

Lightning Grasp: High Performance Procedural Grasp Synthesis with Contact Fields

Zhao-Heng Yin, Pieter Abbeel

机构 * UC Berkeley EECS(伯克利大学电子工程与计算机科学系)

Comments Code: https://github.com/zhaohengyin/lightning-grasp

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02832 2025-11-05 cs.RO cs.CV cs.LG

TWIST2: Scalable, Portable, and Holistic Humanoid Data Collection System

Yanjie Ze, Siheng Zhao, Weizhuo Wang, Angjoo Kanazawa, Rocky Duan, Pieter Abbeel, Guanya Shi, Jiajun Wu, C. Karen Liu

机构 * Amazon FAR(亚马逊 FAR) Stanford University(斯坦福大学) USC(美国大学) UC Berkeley(伯克利大学) CMU(卡内基梅隆大学)

Comments Website: https://yanjieze.com/TWIST2

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25000 2025-10-30 cs.LG

What Really Matters in Matrix-Whitening Optimizers?

Kevin Frans, Pieter Abbeel, Sergey Levine

机构 * UC Berkeley(伯克利大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07254 2025-10-27 cs.LG

A Stable Whitening Optimizer for Efficient Neural Network Training

Kevin Frans, Sergey Levine, Pieter Abbeel

机构 * UC Berkeley(伯克利大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17086 2025-10-21 cs.RO

Learning to Design Soft Hands using Reward Models

Xueqian Bai, Nicklas Hansen, Adabhav Singh, Michael T. Tolley, Yan Duan, Pieter Abbeel, Xiaolong Wang, Sha Yi

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15352 2025-10-20 cs.RO cs.AI cs.GR

GaussGym: An open-source real-to-sim framework for learning locomotion from pixels

Alejandro Escontrela, Justin Kerr, Arthur Allshire, Jonas Frey, Rocky Duan, Carmelo Sferrazza, Pieter Abbeel

机构 * UC Berkeley(伯克利大学) ETH Zurich(苏黎世联邦理工学院) Amazon FAR (Frontier AI & Robotics)(亚马逊前沿人工智能与机器人实验室)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11032 2025-10-14 cs.RO cs.AI cs.CV

DexGarmentLab: Dexterous Garment Manipulation Environment with Generalizable Policy

Yuran Wang, Ruihai Wu, Yue Chen, Jiarui Wang, Jiaqi Liang, Ziyu Zhu, Haoran Geng, Jitendra Malik, Pieter Abbeel, Hao Dong

机构 * Peking University(北京大学) University of California, Berkeley(加州大学伯克利分校)

Comments NeurIPS2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05070 2025-10-09 cs.RO cs.LG

ResMimic: From General Motion Tracking to Humanoid Whole-body Loco-Manipulation via Residual Learning

Siheng Zhao, Yanjie Ze, Yue Wang, C. Karen Liu, Pieter Abbeel, Guanya Shi, Rocky Duan

机构 * Amazon FAR (Frontier AI & Robotics)(亚马逊前沿人工智能与机器人实验室) USC(南加州大学) Stanford University(斯坦福大学) UC Berkeley(加州大学伯克利分校) CMU(卡内基梅隆大学)

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19301 2025-09-29 cs.RO cs.LG

Residual Off-Policy RL for Finetuning Behavior Cloning Policies

Lars Ankile, Zhenyu Jiang, Rocky Duan, Guanya Shi, Pieter Abbeel, Anusha Nagabandi

机构 * Amazon FAR (Frontier AI & Robotics)(亚马逊前沿人工智能与机器人实验室) Stanford University(斯坦福大学) Carnegie Mellon University(卡内基梅隆大学) UC Berkeley(加州大学伯克利分校)

Comments Project website: https://residual-offpolicy-rl.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02864 2025-09-23 cs.RO cs.CV

The Sound of Simulation: Learning Multimodal Sim-to-Real Robot Policies with Generative Audio

Renhao Wang, Haoran Geng, Tingle Li, Feishi Wang, Gopala Anumanchipalli, Trevor Darrell, Boyi Li, Pieter Abbeel, Jitendra Malik, Alexei A. Efros

机构 * University of California, Berkeley(加州大学伯克利分校)

Comments Conference on Robot Learning 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16434 2025-09-23 cs.RO cs.LG

End-to-end RL Improves Dexterous Grasping Policies

Ritvik Singh, Karl Van Wyk, Pieter Abbeel, Jitendra Malik, Nathan Ratliff, Ankur Handa

机构 * NVIDIA University of California, Berkeley(加州大学伯克利分校)

Comments See our blog post: https://e2e4robotics.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06156 2025-09-03 cs.RO

ViTaMIn: Learning Contact-Rich Tasks Through Robot-Free Visuo-Tactile Manipulation Interface

Fangchen Liu, Chuanyu Li, Yihua Qin, Jing Xu, Pieter Abbeel, Rui Chen

机构 * Tsinghua University(清华大学) University of California, Berkeley(加州大学伯克利分校)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03729 2025-09-01 cs.RO cs.CV

Visual Imitation Enables Contextual Humanoid Control

Arthur Allshire, Hongsuk Choi, Junyi Zhang, David McAllister, Anthony Zhang, Chung Min Kim, Trevor Darrell, Pieter Abbeel, Jitendra Malik, Angjoo Kanazawa

机构 * UC Berkeley(伯克利大学)

Comments Project website: https://www.videomimic.net/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18691 2025-08-27 cs.RO

Deep Sensorimotor Control by Imitating Predictive Models of Human Motion

Himanshu Gaurav Singh, Pieter Abbeel, Jitendra Malik, Antonio Loquercio

机构 * UC Berkeley(伯克利大学) University of Pennsylvania(宾夕法尼亚大学)

Comments Blog Post: https://hgaurav2k.github.io/trackr/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14881 2025-08-26 cs.LG

Compute-Optimal Scaling for Value-Based Deep RL

Preston Fu, Oleh Rybkin, Zhiyuan Zhou, Michal Nauman, Pieter Abbeel, Sergey Levine, Aviral Kumar

机构 * University of California, Berkeley(加州大学伯克利分校) Carnegie Mellon University(卡内基梅隆大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12098 2025-08-01 cs.LG cs.AI cs.RO

MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximization

Bhavya Sukhija, Stelian Coros, Andreas Krause, Pieter Abbeel, Carmelo Sferrazza

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21206 2025-07-30 cs.AI cs.LG

Agentic Web: Weaving the Next Web with AI Agents

Yingxuan Yang, Mulei Ma, Yuxuan Huang, Huacan Chai, Chenyu Gong, Haoran Geng, Yuanjian Zhou, Ying Wen, Meng Fang, Muhao Chen, Shangding Gu, Ming Jin, Costas Spanos, Yang Yang, Pieter Abbeel, Dawn Song, Weinan Zhang, Jun Wang

机构 * Shanghai Jiao Tong University(上海交通大学) The Hong Kong University of Science and Technology(香港科技大学) University of Liverpool(利物浦大学) University of California Berkeley(加州大学伯克利分校) Shanghai Innovation Institute(上海创新研究院) University of California Davis(加州大学戴维斯分校) Virginia Tech(弗吉尼亚理工大学) University College London(伦敦大学学院)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04327 2025-07-28 cs.LG

Value-Based Deep RL Scales Predictably

Oleh Rybkin, Michal Nauman, Preston Fu, Charlie Snell, Pieter Abbeel, Sergey Levine, Aviral Kumar

机构 * University of Warsaw(华沙大学)

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04798 2025-07-09 cs.RO cs.AI

From LLMs to Actions: Latent Codes as Bridges in Hierarchical Robot Control

Yide Shentu, Philipp Wu, Aravind Rajeswaran, Pieter Abbeel

机构 * University of California, Berkeley(加州大学伯克利分校)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12557 2025-06-24 cs.LG cs.CV

One Step Diffusion via Shortcut Models

Kevin Frans, Danijar Hafner, Sergey Levine, Pieter Abbeel

机构 * UC Berkeley(伯克利大学)

详情

展开后加载摘要…

URL PDF HTML 收藏