Lyapunov-Guided Self-Alignment: Test-Time Adaptation for Offline Safe Reinforcement Learning
Lyapunov引导的自对齐:用于离线安全强化学习的测试时适应
机构 * Seoul National University(首尔国立大学)
专题命中 安全训练 :alignment(title,abstract);safety(abstract,abstract_cn);分类 cs.AI、cs.LG
AI总结 本文提出SAS框架,通过自对齐机制在不重新训练的情况下实现离线安全强化学习的测试时适应,利用Lyapunov条件筛选可行轨迹并生成上下文提示,提升安全性与性能。
Comments Accepted at AISTATS 2026. First two authors contributed equally. Project page: https://seungyubhan.github.io/sas/. Code: https://github.com/seungyubhan/sas