Many Preferences, Few Policies: Towards Scalable Language Model Personalization
多种偏好,少数政策:迈向可扩展的语言模型个性化
机构 * Harvard University(哈佛大学) ; Carnegie Mellon University(卡内基梅隆大学) ; The Ohio State University(俄亥俄州立大学) ; Massachusetts Institute of Technology(麻省理工学院)
AI总结 本文提出PALM方法,通过多维权重向量建模用户偏好,生成小规模LLM组合以实现个性化,理论保证了规模和近似质量的平衡。
Comments Fixed typos