Cards Against LLMs: Benchmarking Humor Alignment in Large Language Models
卡牌对战大语言模型:大型语言模型幽默对齐的基准测试
机构 * Ghent University(根特大学) ; University of Helsinki(赫尔辛基大学)
专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI
AI总结 本研究通过让五种前沿语言模型与人类玩家玩卡牌对战游戏,评估大语言模型在幽默对齐方面的表现,发现模型在幽默判断上与人类偏好不一致,可能受系统性偏差影响。