Steering Robustness into World Action Models via Mechanistic Interpretability and Optimal Control
通过机制可解释性和最优控制将鲁棒性引入世界行动模型
机构 * Georgia Institute of Technology(佐治亚理工学院)
专题命中 动作表示与策略 :action model(title,abstract);分类 cs.RO、cs.AI、cs.LG
AI总结 研究世界行动模型在分布转移下的脆弱性,利用机制可解释性通过对比激活方向和基于模型的最优控制实现WAM转向,产生WA-LQR,预测不同模型转向能力,在部分模型上提高了对多种扰动的鲁棒性。