D-VLA: A High-Concurrency Distributed Asynchronous Reinforcement Learning Framework for Vision-Language-Action Models
D-VLA:一种面向视觉-语言-动作模型的高并发分布式异步强化学习框架
机构 * Tsinghua University(清华大学) ; Peking University(北京大学) ; Tianjin University(天津大学) ; Beihang University(北航) ; JDT AI Infra(京东AI基础设施)
专题命中 VLA模型 :VLA(title,title_cn);vision-language-action(title,abstract);action model(title);embodied foundation model(abstract)
AI总结 本文提出D-VLA框架,通过平面解耦和四线异步流水线提升大规模视觉-语言-动作模型的并发性和效率,实验显示其在吞吐量和采样效率上优于主流框架。