Doing What They Say, Not What They Reason: Locating the Faithfulness Gap in LLM Agents
做他们所说的,而不是他们所推理的:定位LLM智能体中的忠实性差距
机构 * University of California, Berkeley(加州大学伯克利分校)
AI总结 通过将忠实性差距分解为推理-结论和结论-行动两个步骤,在可控的德克萨斯扑克模拟器中研究LLM智能体是否按照其陈述的推理行动。
Comments submitted to COLM social simulation with LLM workshop