论文
STEB:样式文本嵌入基准
STEB: Style Text Embedding Benchmark
摘要
虽然语义嵌入是在大规模文本嵌入基准上严格评估的,但风格嵌入的评估仍然是碎片化的,每项工作都依赖于自己的一组任务和数据集。为了弥补这一差距,我们引入了样式文本嵌入基准,这是一个全面的开源基准,旨在标准化样式嵌入的评估。 STEB 包含 7 种语言的 96 个数据集,涵盖作者身份验证、作者身份检索、人工智能文本检测、语言特征探测等应用。我们发现语义嵌入在风格任务中始终失败,并且没有一种风格嵌入在所有评估的任务中普遍优于。我们在以下位置开源 STEB 代码库:https://github.com/rrivera1849/STEB。