Preference Optimization Drives Monoculture in LLM Prediction Markets
偏好优化导致LLM预测市场中的单一文化
专题命中 后训练与偏好优化 :LLM(title,title_cn);preference optimization(title,abstract);SFT(abstract,abstract_cn)
AI总结 研究发现,使用直接偏好优化(DPO)微调的LLM代理在预测市场中产生高度相关的错误,导致集体预测能力远低于独立代理数量,且该现象由偏好优化驱动。