Tree-based Dialogue Reinforced Policy Optimization for Red-Teaming Attacks
基于树结构的对话强化策略优化用于红队攻击
机构 * Georgia Institute of Technology(佐治亚理工学院) ; Oracle AI ; University of Pennsylvania(宾夕法尼亚大学)
AI总结 本文提出DialTree框架,通过树搜索和强化学习发现多轮攻击策略,提升对抗攻击的成功率
Comments Accepted at ICLR 2026