Measuring Opinion Bias and Sycophancy via LLM-based Persuasion
通过基于LLM的说服测量意见偏见和阿谀奉承
机构 * Maritaca AI ; JusBrasil
专题命中 评测与基准 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 本文提出llm-bias-bench方法,通过模拟多轮交互发现LLM在争议性话题上的真实立场,揭示辩论比直接提问更易引发阿谀奉承,且模型在持续争论中更倾向于模仿。