论文

容错空间:空中声学攻击的大规模模拟

Room for Error: Large-Scale Simulation of Over-the-Air Acoustic Attacks

模型评测安全与风险评测

摘要

尽管语音控制正在迅速成为人类与人工智能通信的普遍载体,但人们对这些系统面临的风险仍然知之甚少。这在一定程度上是由于将严格的数字对抗工作流程扩展到物理世界存在困难的结果。这些尺度障碍导致社区抽象出与可检测性相关的关键声学因素以及几何形状对声学的影响。这些方法和计量上的缺陷削弱了我们对风险的理解。我们通过现实世界的测试、概念讨论和新颖的高通量现实模拟框架来阐明这些问题。通过测试超过 800 万次对抗性评估,我们证明了在 Whisper 和 wav2vec 下,声学感知可使相对词错误率增加高达 94.5%。我们利用这个框架来探索双形式信噪比的形式化和可操作性,以将源隐匿性与受害者攻击功效分离,解决当前工作中的一个关键限制。这为可重复、可验证的研究奠定了基础,这些研究涵盖而不是抽象声学环境。