Metaphors are a Source of Cross-Domain Misalignment of Large Reasoning Models
隐喻是大推理模型跨领域失调的根源
机构 * The University of New South Wales(新南威尔士大学) ; CSIRO Data61(澳大利亚联邦科学与工业研究组织数据61)
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 研究发现训练数据中的隐喻会导致大推理模型在推理输出中出现跨领域失调,通过隐喻干预可显著改变失调程度,并设计出高精度检测器。
Comments 19 pages, 6 figures