Measuring Judgment Quality in Natural-Language Explanations: Evidence from Forecasting Tournaments
自然语言解释中的判断质量测量:来自预测锦标赛的证据
机构 * Forecasting Research Institute(预测研究所) ; Good Judgment Inc(Good Judgment公司) ; University of Toronto(多伦多大学) ; Vector Institute for Artificial Intelligence(向量人工智能研究所) ; Stanford University(斯坦福大学) ; School of Arts and Sciences & Wharton, University of Pennsylvania(宾夕法尼亚大学文理学院与沃顿商学院) ; Federal Reserve Bank of Chicago(芝加哥联邦储备银行) ; Federal Reserve System(联邦储备系统)
AI总结 提出解释质量标记(EQMs),用大语言模型评分60种理论驱动的推理模式,在超过55,000个预测-理由对中预测准确性,优于传统方法。