论文
AlbanianLLMSafety:阿尔巴尼亚语 大语言模型 的安全评估数据集
AlbanianLLMSafety: A Safety Evaluation Dataset for Large Language Models in Albanian
摘要
大语言模型 (LLM) 的安全评估主要集中在高资源语言上,而对低资源语言的服务严重不足。我们推出了 AlbanianLLMSafety,这是第一个公开可用的阿尔巴尼亚语 LLM 安全评估数据集,阿尔巴尼亚语是一种语言上独特的低资源语言,在阿尔巴尼亚、科索沃、北马其顿和侨民中约有 750 万使用者。该数据集包含 2,951 个提示,涵盖 11 个安全类别,包括自残、暴力、种族主义内容、儿童剥削和激进化,每个类别平均有 268 个提示。每个提示均以阿尔巴尼亚语提供,并附有英文参考翻译和详细的类别标签。该资源解决了低资源语言安全评估基础设施方面的重大差距,并为开发更安全、更具包容性的 LLM 提供了重要基准。该数据集将根据要求提供,以支持阿尔巴尼亚语社区的安全评估、微调、红队和护栏开发。