模型

OpenAI Privacy Filter:开放权重的文本PII检测与遮蔽模型

OpenAI Privacy Filter 开放权重

模型优化小模型/轻量模型

概述

OpenAI发布Privacy Filter并开放模型权重,这是一个双向token分类模型,用于在文本中检测和遮蔽个人身份信息。架构上采用一次前向处理与受约束的跨度解码,可在本地运行,适合数据不出域的场景。模型可识别个人、地址、邮箱、电话、账户号码和密钥等八类敏感跨度。对需要清洗训练语料、日志或RAG检索内容的企业,这提供了比正则规则更精准的开箱选项。