论文
UnBias-Plus:检测、解释和重写偏差
UnBias-Plus: Detect, Explain, and Rewrite Bias
摘要
自然语言的偏见仍然是人类书写和人工智能生成的内容中持续存在的挑战,影响着新闻、教育和人工智能研究等领域。大多数现有的检测方法仅识别偏差的存在,对粒度检测、可解释的解释、中性重写和公开可用的训练模型的支持有限。我们提出了 UnBias-Plus,一个开源工具包,它统一了 (1) 分段级多类偏差分类、(2) 有偏差跨度本地化、(3) 中性文本重写和 (4) 每个决策的推理。 UnBias-Plus 可通过 Python、CLI、REST API 和 Web 界面使用,支持可访问的偏差分析。工具包、源代码、模型、数据集和文档都是公开可用的。