论文
Redakto——LLM的“隐身标签页”
Redakto - The Incognito Tab for LLMs
摘要
大语言模型(LLM)正被日益广泛地用于日常应用。在LLM乃至整个AI的语境中,一大挑战是使用时的隐私保障,即从进入LLM的任何文本中移除个人可识别信息(PII)。随着欧盟新立法的出台,这些挑战变得更加紧迫。在欧盟各国,围绕LLM使用的隐私不确定性可能成为创新速度和研究成果转化为应用的主要阻碍。我们在此提出Redakto,一种可在文本送入LLM或其他下游文本处理之前对其进行匿名化的工具。我们提供最先进的功能,既可用于PII删改(redaction),也可用于假名化(pseudonymization)。这些功能通过Redakto web应用提供给最终用户,通过REST API和模型上下文协议(MCP)钩子提供给开发者与研究者。其实现完全开源,只需适度的计算资源,可以方便地部署在本地硬件上。与以往工作不同,为了更好地评估匿名化文本的质量,我们在法律和医疗领域的文本数据上,围绕删改文本的隐私性和实用性两方面开展了大量实证评估。我们的实证结果表明,采用不同删改策略匿名化的文本,其实用性得分与原始文本相当,这表明用Redakto进行匿名化可以在我们所探索的任务中用于LLM流程,而不会产生实质性的负面影响。
