Teaching a Large Language Model Tutor to Withhold the Answer: A Supervisor Architecture and an Evidence-Driven Method for Tuning Socratic Behavior
训练大型语言模型助教以保留答案:一种用于调整苏格拉底式行为的监督架构与证据驱动方法
专题命中 Agent评测 :agent(abstract)
AI总结 本研究提出一种监督架构与证据驱动方法,训练LLM助教执行答案保留,通过自动评估调整苏格拉底式行为,使其在全部四个接受标准上达到完全合规。