TTT-VLA: Test-Time Latent Prompt Optimization for Vision-Language-Action Models
TTT-VLA:面向视觉-语言-动作模型的测试时潜在提示优化
机构 * ByteDance Seed(字节跳动种子) ; The University of Adelaide(阿德莱德大学) ; Tsinghua University(清华大学) ; Zhejiang University(浙江大学) ; The University of Hong Kong(香港大学) ; CSIRO Data61
专题命中 VLA模型 :VLA(title,title_cn);vision-language-action(title,abstract);action model(title);分类 cs.RO
AI总结 提出TTT-VLA框架,通过测试时优化潜在提示来适应分布偏移,无需修改策略本身,在SimperEnv上提升单/多实体任务成功率。