Manufactured Divisiveness: Decomposing the Hostile Content of Seven Social Media Influence Operations
人为制造的分裂:剖析七种社交媒体影响行动中的恶意内容
机构 * Department of Computer Science University of Southern California(计算机科学系 美国南加州大学)
AI总结 研究推特中七种政府认定活动推文里的恶意内容,通过双提示大语言模型检测器和可审计规则区分仇恨与其他分裂形式,发现将所有相关内容计为仇恨会高估,有助于重新定义影响活动及在线话语中仇恨的研究。