LLMs as a Jury: Cross-Model Consensus Can Outperform Process Reward Models for LLM Reasoning
作为陪审团的语言模型:跨模型共识在语言模型推理方面可超越过程奖励模型
专题命中 测试时计算 :reasoning(title,abstract);verifier(abstract);分类 cs.AI、cs.LG
AI总结 研究在语言模型推理中从候选推理链选正确答案的问题,提出跨模型共识方法,将其视为语言模型陪审团,通过错误去相关机制工作,在多个基准测试中表现出色,能预先表征,有定律和下限。