arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Washington(华盛顿大学)

2026-08-13 至 2026-08-13 共收录 2
2605.12236 2026-08-13 cs.RO cs.AI cs.LG 版本更新

TMRL: Diffusion Timestep-Modulated Pretraining Enables Exploration for Efficient Policy Finetuning

TMRL: 差分时间步调节预训练实现高效策略微调的探索

Matthew M. Hong, Jesse Zhang, Anusha Nagabandi, Abhishek Gupta

机构 * University of Washington(华盛顿大学) Amazon FAR(亚马逊FAR)

AI总结 本文提出TMRL框架,通过结合行为克隆预训练与强化学习微调,解决预训练中动作分布狭窄的问题,提升机器人策略微调的样本效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12283 2026-08-13 cs.AI cs.MA 版本更新

Deep Fictitious Play-Based Potential Differential Games for Learning Human-Like Interaction at Unsignalized Intersections

基于深度虚拟博弈的势微分博弈:用于学习无信号交叉口的类人交互

Kehua Chen, Ryan Feng Lin, Shucheng Zhang, Yinhai Wang

机构 * Department of Civil and Environmental Engineering, University of Washington(华盛顿大学土木与环境工程系)

AI总结 本研究提出DFP-PDG框架,首次用深度虚拟博弈学习无信号交叉口类人交互驾驶策略,经INTERACTION数据集验证有效,可捕捉驾驶风格差异并保证收敛。

详情

展开后加载摘要…

URL PDF HTML 收藏