arXivDaily arXiv每日学术速递 周一至周五更新

作者

Chelsea Finn

Robotics / Machine Learning

共收录 305
2602.01439 2026-02-03 cs.LG cs.AI

TQL: Scaling Q-Functions with Transformers by Preventing Attention Collapse

TQL: 通过防止注意力崩溃来扩展Q函数

Perry Dong, Kuo-Han Hung, Alexander Swerdlow, Dorsa Sadigh, Chelsea Finn

机构 * Stanford University(斯坦福大学)

AI总结 TQL通过防止注意力崩溃,提升Transformer在强化学习中扩展价值函数的性能,实现43%的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16163 2026-01-23 cs.AI cs.RO

Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning

Cosmos Policy: 为视觉运动控制和规划微调视频模型

Moo Jin Kim, Yihuai Gao, Tsung-Yi Lin, Yen-Chen Lin, Yunhao Ge, Grace Lam, Percy Liang, Shuran Song, Ming-Yu Liu, Chelsea Finn, Jinwei Gu

机构 * NVIDIA Stanford University(斯坦福大学)

AI总结 Cosmos Policy通过单阶段后训练将预训练视频模型转化为高效机器人策略,实现视觉运动控制与规划的先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.24164 2026-01-09 cs.LG cs.RO

$π_0$: A Vision-Language-Action Flow Model for General Robot Control

π₀:一种面向通用机器人控制的视觉-语言-动作流模型

Kevin Black, Noah Brown, Danny Driess, Adnan Esmail, Michael Equi, Chelsea Finn, Niccolo Fusai, Lachy Groom, Karol Hausman, Brian Ichter, Szymon Jakubczak, Tim Jones, Liyiming Ke, Sergey Levine, Adrian Li-Bell, Mohith Mothukuri, Suraj Nair, Karl Pertsch, Lucy Xiaoyang Shi, James Tanner, Quan Vuong, Anna Walling, Haohuan Wang, Ury Zhilinsky

机构 * Physical Intelligence

AI总结 本文提出了一种基于预训练视觉-语言模型的流匹配架构,用于通用机器人控制,通过零样本学习和微调实现多样任务的执行。

Comments See project website for videos: https://physicalintelligence.company/blog/pi0 Published in RSS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00675 2026-01-09 cs.RO

RoboReward: General-Purpose Vision-Language Reward Models for Robotics

RoboReward: 通用视觉-语言奖励模型用于机器人学

Tony Lee, Andrew Wagenmaker, Karl Pertsch, Percy Liang, Sergey Levine, Chelsea Finn

AI总结 RoboReward通过构建机器人奖励数据集和基准,训练视觉-语言奖励模型,验证了其在机器人学习中的有效性,并展示了改进策略学习和缩小与人工奖励差距的成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16881 2026-01-01 cs.RO cs.LG

PolaRiS: Scalable Real-to-Sim Evaluations for Generalist Robot Policies

PolaRiS:面向通用机器人策略的可扩展真实-仿真评估

Arhan Jain, Mingtong Zhang, Kanav Arora, William Chen, Marcel Torne, Muhammad Zubair Irshad, Sergey Zakharov, Yue Wang, Sergey Levine, Chelsea Finn, Wei-Chiu Ma, Dhruv Shah, Abhishek Gupta, Karl Pertsch

机构 * University of Washington(华盛顿大学) Princeton University(普林斯顿大学) University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) Toyota Research Institute(丰田研究中心) University of Southern California(南加州大学) Cornell University(康奈尔大学)

AI总结 PolaRiS通过神经重建和数据协同训练,实现高保真度的机器人策略真实-仿真评估,提升仿真与现实的关联性并简化环境构建。

Comments Website: https://polaris-evals.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07919 2026-01-01 cs.LG

Feedback Descent: Open-Ended Text Optimization via Pairwise Comparison

反馈下降:通过成对比较实现开放式的文本优化

Yoonho Lee, Joseph Boen, Chelsea Finn

机构 * Stanford University(斯坦福大学)

AI总结 Feedback Descent通过结构化文本反馈实现开放式文本优化,优于现有方法并在分子发现中表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22414 2025-12-30 cs.RO cs.AI

Emergence of Human to Robot Transfer in Vision-Language-Action Models

视觉-语言-动作模型中人类到机器人的转移现象出现

Simar Kareer, Karl Pertsch, James Darpinian, Judy Hoffman, Danfei Xu, Sergey Levine, Chelsea Finn, Suraj Nair

机构 * Physical Intelligence(物理智能) Georgia Institute of Technology(佐治亚理工学院)

AI总结 本文提出了一种简单的方法,通过预训练视觉-语言-动作模型,使模型能从人类数据中学习并转移至机器人任务,从而提升泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16911 2025-12-19 cs.LG cs.AI cs.RO

Posterior Behavioral Cloning: Pretraining BC Policies for Efficient RL Finetuning

后验行为克隆:为高效强化学习微调预训练BC策略

Andrew Wagenmaker, Perry Dong, Raymond Tsao, Chelsea Finn, Sergey Levine

机构 * UC Berkeley(伯克利大学) Stanford(斯坦福大学)

AI总结 本文提出后验行为克隆策略,通过建模示范者行为的后验分布来提升强化学习微调效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05230 2025-12-08 cs.RO cs.AI

Invariance Co-training for Robot Visual Generalization

机器人视觉泛化中的不变性协同训练

Jonathan Yang, Chelsea Finn, Dorsa Sadigh

AI总结 该研究通过引入状态相似性和观测扰动不变性辅助任务,提升机器人在多样视角、光照和干扰物体下的泛化能力,实验表明其性能比现有方法提高了18%。

Comments 14 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18123 2025-12-02 cs.RO cs.LG

RoboArena: Distributed Real-World Evaluation of Generalist Robot Policies

RoboArena: 分布式现实世界中通用机器人策略的评估

Pranav Atreya, Karl Pertsch, Tony Lee, Moo Jin Kim, Arhan Jain, Artur Kuramshin, Clemens Eppner, Cyrus Neary, Edward Hu, Fabio Ramos, Jonathan Tremblay, Kanav Arora, Kirsty Ellis, Luca Macesanu, Marcel Torne Villasevil, Matthew Leonard, Meedeum Cho, Ozgur Aslan, Shivin Dass, Jie Wang, William Reger, Xingfang Yuan, Xuning Yang, Abhishek Gupta, Dinesh Jayaraman, Glen Berseth, Kostas Daniilidis, Roberto Martin-Martin, Youngwoon Lee, Percy Liang, Chelsea Finn, Sergey Levine

AI总结 RoboArena通过分布式众包评估,实现了对通用机器人策略在现实世界中的可扩展、可靠评估,优于传统集中化方法。

Comments Website: https://robo-arena.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14759 2025-11-20 cs.LG cs.RO

$π^{*}_{0.6}$: a VLA That Learns From Experience

Physical Intelligence, Ali Amin, Raichelle Aniceto, Ashwin Balakrishna, Kevin Black, Ken Conley, Grace Connors, James Darpinian, Karan Dhabalia, Jared DiCarlo, Danny Driess, Michael Equi, Adnan Esmail, Yunhao Fang, Chelsea Finn, Catherine Glossop, Thomas Godden, Ivan Goryachev, Lachy Groom, Hunter Hancock, Karol Hausman, Gashon Hussein, Brian Ichter, Szymon Jakubczak, Rowan Jen, Tim Jones, Ben Katz, Liyiming Ke, Chandra Kuchi, Marinda Lamb, Devin LeBlanc, Sergey Levine, Adrian Li-Bell, Yao Lu, Vishnu Mano, Mohith Mothukuri, Suraj Nair, Karl Pertsch, Allen Z. Ren, Charvi Sharma, Lucy Xiaoyang Shi, Laura Smith, Jost Tobias Springenberg, Kyle Stachowicz, Will Stoeckle, Alex Swerdlow, James Tanner, Marcel Torne, Quan Vuong, Anna Walling, Haohuan Wang, Blake Williams, Sukwon Yoo, Lili Yu, Ury Zhilinsky, Zhiyuan Zhou

机构 * Physical Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20965 2025-10-27 cs.RO cs.LG

SutureBot: A Precision Framework & Benchmark For Autonomous End-to-End Suturing

Jesse Haworth, Juo-Tung Chen, Nigel Nelson, Ji Woong Kim, Masoud Moghani, Chelsea Finn, Axel Krieger

机构 * Johns Hopkins University(约翰霍普金斯大学) NVIDIA(英伟达) Stanford University(斯坦福大学) University of Toronto(多伦多大学)

Comments 10 pages, 5 figures, 4 tables, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20328 2025-10-24 cs.RO cs.AI cs.LG

MemER: Scaling Up Memory for Robot Control via Experience Retrieval

Ajay Sridhar, Jennifer Pan, Satvik Sharma, Chelsea Finn

机构 * Stanford University(斯坦福大学)

Comments Project page: https://jen-pan.github.io/memer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02263 2025-10-03 cs.AI cs.CL cs.LG

RLAD: Training LLMs to Discover Abstractions for Solving Reasoning Problems

Yuxiao Qu, Anikait Singh, Yoonho Lee, Amrith Setlur, Ruslan Salakhutdinov, Chelsea Finn, Aviral Kumar

机构 * Carnegie Mellon University(卡内基梅隆大学) Stanford University(斯坦福大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12189 2025-08-19 cs.RO cs.AI

Self-Guided Action Diffusion

Rhea Malhotra, Yuejiang Liu, Chelsea Finn

机构 * Stanford University(斯坦福大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06232 2025-08-05 q-bio.NC cs.AI cs.LG cs.NE

Range, not Independence, Drives Modularity in Biologically Inspired Representations

Will Dorrell, Kyle Hsu, Luke Hollingsworth, Jin Hwa Lee, Jiajun Wu, Chelsea Finn, Peter E Latham, Tim EJ Behrens, James CR Whittington

机构 * Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家) School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家)

Comments 37 pages, 12 figures. WD and KH contributed equally; LH and JHL contributed equally

Journal ref Proceedings of the 13th International Conference on Learning Representations, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10341 2025-07-29 cs.RO cs.AI cs.LG

Affordance-Guided Reinforcement Learning via Visual Prompting

Olivia Y. Lee, Annie Xie, Kuan Fang, Karl Pertsch, Chelsea Finn

机构 * Stanford University(斯坦福大学) Cornell University(康奈尔大学) University of California, Berkeley(加州大学伯克利分校)

Comments 8 pages, 6 figures. IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03707 2025-07-23 cs.RO cs.AI cs.LG

Curating Demonstrations using Online Experience

Annie S. Chen, Alec M. Lessing, Yuejiang Liu, Chelsea Finn

机构 * Stanford University(斯坦福大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01059 2025-07-23 cs.RO cs.LG

Adapt On-the-Go: Behavior Modulation for Single-Life Robot Deployment

Annie S. Chen, Govind Chada, Laura Smith, Archit Sharma, Zipeng Fu, Sergey Levine, Chelsea Finn

机构 * Stanford University(斯坦福大学) UC Berkeley(加州大学伯克利分校)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19417 2025-07-16 cs.RO cs.AI cs.LG

Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models

Lucy Xiaoyang Shi, Brian Ichter, Michael Equi, Liyiming Ke, Karl Pertsch, Quan Vuong, James Tanner, Anna Walling, Haohuan Wang, Niccolo Fusai, Adrian Li-Bell, Danny Driess, Lachy Groom, Sergey Levine, Chelsea Finn

机构 * Stanford University(斯坦福大学) University of California, Berkeley(加州大学伯克利分校)

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10251 2025-07-09 cs.RO

SRT-H: A Hierarchical Framework for Autonomous Surgery via Language Conditioned Imitation Learning

Ji Woong Kim, Juo-Tung Chen, Pascal Hansen, Lucy X. Shi, Antony Goldenberg, Samuel Schmidgall, Paul Maria Scheikl, Anton Deguet, Brandon M. White, De Ru Tsai, Richard Cha, Jeffrey Jopling, Chelsea Finn, Axel Krieger

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07505 2025-06-10 cs.LG cs.AI

Reinforcement Learning via Implicit Imitation Guidance

Perry Dong, Alec M. Lessing, Annie S. Chen, Chelsea Finn

机构 * Stanford University(斯坦福大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05256 2025-06-09 cs.AI cs.LG

Just Enough Thinking: Efficient Reasoning with Adaptive Length Penalties Reinforcement Learning

Violet Xiang, Chase Blagden, Rafael Rafailov, Nathan Lile, Sang Truong, Chelsea Finn, Nick Haber

机构 * Stanford University(斯坦福大学) SynthLabs

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.08028 2025-05-30 cs.LG

A Tutorial on Meta-Reinforcement Learning

Jacob Beck, Risto Vuorio, Evan Zheran Liu, Zheng Xiong, Luisa Zintgraf, Chelsea Finn, Shimon Whiteson

Comments Published in Foundations and Trends in Machine Learning as "A Tutorial on Meta-Reinforcement Learning". For the earlier version titled "A Survey of Meta-Reinforcement Learning", see v3 in the submission history at arXiv:2301.08028v3

Journal ref Foundations and Trends in Machine Learning: Vol. 18, No. 2-3, pp 224-384 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01915 2025-05-22 cs.RO

RoboCrowd: Scaling Robot Data Collection through Crowdsourcing

Suvir Mirchandani, David D. Yuan, Kaylee Burns, Md Sazzad Islam, Tony Z. Zhao, Chelsea Finn, Dorsa Sadigh

Comments 21 pages, 25 figures. International Conference on Robotics and Automation (ICRA) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09561 2025-05-21 cs.RO cs.AI cs.LG

Learning Long-Context Diffusion Policies via Past-Token Prediction

Marcel Torne, Andy Tang, Yuejiang Liu, Chelsea Finn

机构 * Stanford University(斯坦福大学)

Comments Videos are available at https://long-context-dp.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08864 2025-05-15 cs.RO

Open X-Embodiment: Robotic Learning Datasets and RT-X Models

Embodiment Collaboration, Abby O'Neill, Abdul Rehman, Abhinav Gupta, Abhiram Maddukuri, Abhishek Gupta, Abhishek Padalkar, Abraham Lee, Acorn Pooley, Agrim Gupta, Ajay Mandlekar, Ajinkya Jain, Albert Tung, Alex Bewley, Alex Herzog, Alex Irpan, Alexander Khazatsky, Anant Rai, Anchit Gupta, Andrew Wang, Andrey Kolobov, Anikait Singh, Animesh Garg, Aniruddha Kembhavi, Annie Xie, Anthony Brohan, Antonin Raffin, Archit Sharma, Arefeh Yavary, Arhan Jain, Ashwin Balakrishna, Ayzaan Wahid, Ben Burgess-Limerick, Beomjoon Kim, Bernhard Schölkopf, Blake Wulfe, Brian Ichter, Cewu Lu, Charles Xu, Charlotte Le, Chelsea Finn, Chen Wang, Chenfeng Xu, Cheng Chi, Chenguang Huang, Christine Chan, Christopher Agia, Chuer Pan, Chuyuan Fu, Coline Devin, Danfei Xu, Daniel Morton, Danny Driess, Daphne Chen, Deepak Pathak, Dhruv Shah, Dieter Büchler, Dinesh Jayaraman, Dmitry Kalashnikov, Dorsa Sadigh, Edward Johns, Ethan Foster, Fangchen Liu, Federico Ceola, Fei Xia, Feiyu Zhao, Felipe Vieira Frujeri, Freek Stulp, Gaoyue Zhou, Gaurav S. Sukhatme, Gautam Salhotra, Ge Yan, Gilbert Feng, Giulio Schiavi, Glen Berseth, Gregory Kahn, Guangwen Yang, Guanzhi Wang, Hao Su, Hao-Shu Fang, Haochen Shi, Henghui Bao, Heni Ben Amor, Henrik I Christensen, Hiroki Furuta, Homanga Bharadhwaj, Homer Walke, Hongjie Fang, Huy Ha, Igor Mordatch, Ilija Radosavovic, Isabel Leal, Jacky Liang, Jad Abou-Chakra, Jaehyung Kim, Jaimyn Drake, Jan Peters, Jan Schneider, Jasmine Hsu, Jay Vakil, Jeannette Bohg, Jeffrey Bingham, Jeffrey Wu, Jensen Gao, Jiaheng Hu, Jiajun Wu, Jialin Wu, Jiankai Sun, Jianlan Luo, Jiayuan Gu, Jie Tan, Jihoon Oh, Jimmy Wu, Jingpei Lu, Jingyun Yang, Jitendra Malik, João Silvério, Joey Hejna, Jonathan Booher, Jonathan Tompson, Jonathan Yang, Jordi Salvador, Joseph J. Lim, Junhyek Han, Kaiyuan Wang, Kanishka Rao, Karl Pertsch, Karol Hausman, Keegan Go, Keerthana Gopalakrishnan, Ken Goldberg, Kendra Byrne, Kenneth Oslund, Kento Kawaharazuka, Kevin Black, Kevin Lin, Kevin Zhang, Kiana Ehsani, Kiran Lekkala, Kirsty Ellis, Krishan Rana, Krishnan Srinivasan, Kuan Fang, Kunal Pratap Singh, Kuo-Hao Zeng, Kyle Hatch, Kyle Hsu, Laurent Itti, Lawrence Yunliang Chen, Lerrel Pinto, Li Fei-Fei, Liam Tan, Linxi "Jim" Fan, Lionel Ott, Lisa Lee, Luca Weihs, Magnum Chen, Marion Lepert, Marius Memmel, Masayoshi Tomizuka, Masha Itkina, Mateo Guaman Castro, Max Spero, Maximilian Du, Michael Ahn, Michael C. Yip, Mingtong Zhang, Mingyu Ding, Minho Heo, Mohan Kumar Srirama, Mohit Sharma, Moo Jin Kim, Muhammad Zubair Irshad, Naoaki Kanazawa, Nicklas Hansen, Nicolas Heess, Nikhil J Joshi, Niko Suenderhauf, Ning Liu, Norman Di Palo, Nur Muhammad Mahi Shafiullah, Oier Mees, Oliver Kroemer, Osbert Bastani, Pannag R Sanketi, Patrick "Tree" Miller, Patrick Yin, Paul Wohlhart, Peng Xu, Peter David Fagan, Peter Mitrano, Pierre Sermanet, Pieter Abbeel, Priya Sundaresan, Qiuyu Chen, Quan Vuong, Rafael Rafailov, Ran Tian, Ria Doshi, Roberto Martín-Martín, Rohan Baijal, Rosario Scalise, Rose Hendrix, Roy Lin, Runjia Qian, Ruohan Zhang, Russell Mendonca, Rutav Shah, Ryan Hoque, Ryan Julian, Samuel Bustamante, Sean Kirmani, Sergey Levine, Shan Lin, Sherry Moore, Shikhar Bahl, Shivin Dass, Shubham Sonawani, Shubham Tulsiani, Shuran Song, Sichun Xu, Siddhant Haldar, Siddharth Karamcheti, Simeon Adebola, Simon Guist, Soroush Nasiriany, Stefan Schaal, Stefan Welker, Stephen Tian, Subramanian Ramamoorthy, Sudeep Dasari, Suneel Belkhale, Sungjae Park, Suraj Nair, Suvir Mirchandani, Takayuki Osa, Tanmay Gupta, Tatsuya Harada, Tatsuya Matsushima, Ted Xiao, Thomas Kollar, Tianhe Yu, Tianli Ding, Todor Davchev, Tony Z. Zhao, Travis Armstrong, Trevor Darrell, Trinity Chung, Vidhi Jain, Vikash Kumar, Vincent Vanhoucke, Vitor Guizilini, Wei Zhan, Wenxuan Zhou, Wolfram Burgard, Xi Chen, Xiangyu Chen, Xiaolong Wang, Xinghao Zhu, Xinyang Geng, Xiyuan Liu, Xu Liangwei, Xuanlin Li, Yansong Pang, Yao Lu, Yecheng Jason Ma, Yejin Kim, Yevgen Chebotar, Yifan Zhou, Yifeng Zhu, Yilin Wu, Ying Xu, Yixuan Wang, Yonatan Bisk, Yongqiang Dou, Yoonyoung Cho, Youngwoon Lee, Yuchen Cui, Yue Cao, Yueh-Hua Wu, Yujin Tang, Yuke Zhu, Yunchu Zhang, Yunfan Jiang, Yunshuang Li, Yunzhu Li, Yusuke Iwasawa, Yutaka Matsuo, Zehan Ma, Zhuo Xu, Zichen Jeff Cui, Zichen Zhang, Zipeng Fu, Zipeng Lin

Comments Project website: https://robotics-transformer-x.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08078 2025-05-14 cs.RO cs.AI

What Matters for Batch Online Reinforcement Learning in Robotics?

Perry Dong, Suvir Mirchandani, Dorsa Sadigh, Chelsea Finn

机构 * Stanford University(斯坦福大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19645 2025-04-29 cs.RO cs.AI cs.CV cs.LG

Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success

Moo Jin Kim, Chelsea Finn, Percy Liang

Comments Accepted to Robotics: Science and Systems (RSS) 2025. Project website: https://openvla-oft.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.17355 2025-04-28 cs.RO cs.AI cs.LG

Bidirectional Decoding: Improving Action Chunking via Guided Test-Time Sampling

Yuejiang Liu, Jubayer Ibn Hamid, Annie Xie, Yoonho Lee, Maximilian Du, Chelsea Finn

机构 * Department of Computer Science, Stanford University(计算机科学系,斯坦福大学)

Comments Project website: https://bid-robot.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏