← 返回精选动态
精选动态

Introducing OpenAI Privacy Filter

OpenAI 发布 Privacy Filter(1.5B 参数, 128000 tokens 上下文)

更新于 2026年05月21日 14:55 1 条公开来源

发生了什么

OpenAI 发布 Privacy Filter(1.5B 参数, 128000 tokens 上下文)

为什么值得关注

值得重点看模型架构与标签体系设计,尤其是本地部署、单次前向推理和长上下文脱敏在生产流程中的落地方式。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

Introducing OpenAI Privacy Filter

OpanAI-Research 2026年04月22日 08:00

OpenAI 发布了 Privacy Filter,一个开源权重的文本 PII 检测与脱敏模型,支持在本地运行,面向训练、索引、日志和审核等隐私工作流。该模型是双向 token-classification 架构,支持最长 128,000 tokens 上下文,总参数量 1.5B、活跃参数 50M,可一次前向推理完成标签判定并用约束 Viterbi 解码成连续 span。OpenAI 表示,该版本在修正评测中的标注问题后,在 PII-Masking-300k 基准上达到 SOTA;模型可识别 8 类内容,包括 private_person、private_address、private_email、private_phone、private_url、private_date、account_number 和 secret。

打开原始来源 ↗
← 返回精选动态