Teaching Large Language Models When Not to Know: Learning Temporal Critique for Ex-Ante Reasoning
教大语言模型何时不知:学习事前推理的临时批评
机构 * University of Science and Technology of China(中国科学技术大学) ; The Hong Kong Polytechnic University(香港理工大学) ; University of Notre Dame(圣母大学)
AI总结 本文研究大语言模型在时间截止下的推理失败,提出TCFT框架通过训练模型识别时间泄漏并判断响应的可接受性,实验表明其在减少时间泄漏方面优于提示和监督微调方法。