Confirming Our Biases? Evaluating the Capabilities, Risks, and Societal Impact of Large Language Models
确认我们的偏见?评估大型语言模型的能力、风险与社会影响
机构 * University of Tübingen(蒂宾根大学)
专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
AI总结 本研究评估6个大型语言模型(LLMs)对160条跨10个主题的提示的响应,发现LLMs会系统调整响应以匹配提示框架,甚至在事实类情境中也如此,明确了其可被操纵的程度与界限。