论文
部分语音欺骗中的时间锚点和编辑灵敏度:一项对照研究
Temporal Anchors and Editing Sensitivity in Partial Speech Spoofing: A Controlled Study
摘要
部分欺骗检测器必须拒绝合成内容,同时接受良性编辑。我们使用冻结的 WavLM 特征、非语言单元控制和源锁定评估来诊断时间锚点和边界一致性训练。真-真和真-假拼接对比编辑误报和合成内容遗漏;他们没有分离出独特的因果产物。凭借第 6 层功能,手机单元的 PartialSpoof 评估框架 EER 高于软框架(11.18% 与 9.59%)。在 500 个回顾性 PS 评估案例中,增强减少了真正拼接的误报;合成核心未命中的 PS 开发 FPR 增加 5%,但不明显增加 1%。 200 例 Llama A 后续行动保留了误报率的减少,但并未增加误报率。推定案例排名可以提高,而固定阈值失误会增加。一致性不会带来统一的增益,编码器层排名在语料库上会发生变化。我们用三个种子(包括单词单元)报告框架和事件定位,并将 PS 评估视为回顾性的。审核代码、选定的训练脚本和结果摘要可在 https://github.com/mysxs/partial-spoof-diagnostics. 上获取