Can LLMs Refuse Questions They Do Not Know? Measuring Knowledge-Aware Refusal in Factual Tasks
大语言模型能否拒绝它们不知道的问题?在事实性任务中测量知识感知的拒绝
机构 * Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系) ; Harbin Institute of Technology(哈尔滨工业大学) ; College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院) ; School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院)
AI总结 本文提出Refusal Index(RI)作为衡量大语言模型知识感知拒绝能力的新指标,通过评估拒绝概率与错误概率的相关性,揭示模型在事实性任务中的可靠性问题。
Comments Accepted at ICLR 2026