论文
看看你给我们带来了什么集群:从 Reddit 话语中提取仇恨叙事
Look What You Made Us Cluster: Hate Narrative Extraction from Reddit Discourse
摘要
叙事提取使我们能够识别在线仇恨叙事,支持构建严格的检测系统。然而,现有的计算方法在精度上受到限制,因为它们依赖于语义表示,而语义表示往往只捕获表面层的含义。为了检测更精确和可解释的叙述,我们提出了一个提取管道,将叙述表示为实体评估对。使用大语言模型 (LLM) 推理过程提取叙述,该推理过程扩展了基于方面的情感分析,识别方面,将其判断类型分类为评估的基础,并相应地得出评估。然后使用莱顿对提取的叙述进行聚类,然后通过大语言模型指导的细化过程将聚类解析到预期的粒度级别。我们用 2024 年批评泰勒·斯威夫特的英语 Reddit 评论来说明这一叙事流程,分析了表现出仇恨言论模式的代表性集群,以证明其解释价值。