论文

SynSFX:用于 Deepfake 检测和评估的多模型音效合成数据集

SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation

模型评测基准与评测资源

摘要

虽然音频深度伪造检测取得了显着进步,但代表性检测器对合成声音效果的泛化能力有限。 EnvSDD 等现有环境音频数据集提供了重要的初始资源,但对于研究孤立的声音效果深度赝品而言,其规模和生成来源仍然有限。为了支持这个方向,我们推出了 SynSFX,这是一个包含 43374 个剪辑(26452 个合成片段,16922 个真实片段)的大型语料库,涵盖 7 个流行的文本到音频模型。