Telescope: Improving Zero Shot Detection of LLM Generated Content By Measuring Token Repetition Probability
望远镜:通过测量令牌重复概率改进大语言模型生成内容的零样本检测
AI总结 研究区分大语言模型生成文本与人类写作的难题,提出用望远镜困惑度衡量模型令牌重复,揭示该特征在预训练早期出现,能有效进行零样本检测,性能优于其他方法。
Comments 50 pages, ICML, 20 figures, Equal contribution