PoliticsBench: Benchmarking Political Values in Large Language Models with Multi-Turn Roleplay
PoliticsBench: 通过多轮角色扮演基准测试大型语言模型中的政治价值观
机构 * Northville High School, Northville, USA(北维尅高中) ; Department of Computer Science, Stanford University, Stanford, USA(斯坦福大学计算机科学系)
专题命中 评测与基准 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);prompting(abstract)
AI总结 提出PoliticsBench,一个多阶段角色扮演基准,通过20个演化场景评估LLM的细粒度价值表达,发现场景提示比直接提问能引发更广泛和强烈的价值表达。
Comments 7 pages, 5 tables, 5 figures, 4 appendix pages. Accepted to the ICML 2026 Trustworthy AI for Good Workshop