Forged Peer Judgments Mislead Multimodal LLM Judge Panels: Source-Blind Anchoring and Panel-Consensus Verification
伪造的同行判断会误导多模态大语言模型(LLM)评判小组:无来源锚定与小组共识验证
机构 * Zhejiang University(浙江大学)
专题命中 评测与基准 :LLM(title,title_cn);language model(abstract)
AI总结 研究发现多模态LLM评判小组存在无来源锚定的文本攻击面,伪造同行判断可误导判决,提出的小组共识验证方法能有效阻断此类攻击并降低损害。