技术实践
Meta以AI和治理流程辅助隐私资产分类
概述
Meta在在 AI 原生时代做数据资产分类,支撑隐私控制场景中应用AI。Meta 的隐私基础设施(PAI)以资产分类为底座:同一个字段名在不同语境下治理结论不同(age 描述自然人时是个人数据,作为缓存 TTL 时只是系统元数据),所以不能只靠字段名判断。已实施机制:Meta 采用混合模式做大规模资产分类——①把人工复核标签与模型生成的推荐分开存放;②把稳定的行为蒸馏成确定性的、带版本管理的规则,用于日常强制执行;③LLM 只在窄范围、有意识地使用:判读新颖或有歧义的资产,再把学到的东西蒸馏成经人工复核的版本化确定性规则,不断缩小需要 LLM 判断的范围。原文明确:常见生产请求不由 LLM 做生产决定,由确定性规则决定(发布方自述口径)。