Do Language Models Converge to Themselves? Recursive Self-Refinement as Textual Relaxation
语言模型会收敛到自身吗?递归自精炼作为文本松弛
机构 * Pfizer(辉瑞公司) ; University of California San Diego(加利福尼亚大学圣地亚哥分校) ; Institute for Medical Philosophy and Future Artificial Intelligence(医学哲学与未来人工智能研究所) ; Tongji University(同济大学) ; Shanghai Jiao Tong University(上海交通大学) ; Institute of Humanities and Social Science Data, Fudan University(复旦大学人文社会科学数据研究所)
专题命中 评测与基准 :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.AI
AI总结 研究大语言模型递归自精炼工作流程的长期动态。通过生成精炼轨迹并分析多种指标,发现轨迹迅速饱和,编辑多在前几次迭代,确定性解码表现更好,平均编辑幅度呈指数松弛,收敛摘要有多种优势,支持动态系统观点并推动停止标准。