LLM Detection as an Intervention: Downstream Impact under Strategic User Behavior
作为一种干预手段的大语言模型检测:战略用户行为下的下游影响
机构 * Stanford University(斯坦福大学) ; University of Pennsylvania(宾夕法尼亚大学) ; Cornell University(康奈尔大学)
AI总结 研究LLM检测对下游指标的影响,开发程式化模型捕捉用户策略行为。发现不完善的检测器会扭曲LLM使用及输出质量,导致用户增加使用量且输出质量可能降低,还呈现“先升后降”检测模式,揭示了检测干预的失效模式。