论文

通过范围编码实现高效、可证明安全的语言隐写术

Efficient Provably Secure Linguistic Steganography via Range Coding

模型推理解码与生成控制

摘要

语言隐写术涉及将秘密消息嵌入看似无害的文本中,以实现秘密通信。可证明的安全性是一个长期目标和关键动机,已扩展到基于语言模型的隐写术。以前可证明安全的方法已经实现了完美的不可察觉性,通过零 Kullback-Leibler (KL) 散度来衡量,但代价是嵌入容量。在本文中,我们尝试直接使用经典的熵编码方法(范围编码)来实现安全的隐写术,然后提出一种具有旋转机制的高效且可证明安全的语言隐写方法。各种语言模型的实验表明,我们的方法在嵌入容量方面实现了大约 100% 的熵利用率(嵌入效率),优于现有的基线方法。此外,它还实现了高嵌入速度(GPT-2 上高达 1554.66 位/秒)。该代码可在 github.com/ryehr/RRC_steganography 上获取。