Active Query Synthesis for Preference Learning
用于偏好学习的主动查询合成
机构 * Georgia Institute of Technology(佐治亚理工学院) ; Gauss Labs(Gauss实验室)
AI总结 针对偏好学习中的查询反馈可靠性问题和池评估计算瓶颈,提出基于互信息最大化的连续空间主动查询合成框架Info-Synth,并扩展出两种有限池查询策略,在合成数据、文本摘要和机器人控制任务上验证了有效性。
Comments 27 pages, 12 figures