实用工具

个人信息脱敏工具(发给 AI 之前用)

把文本粘贴给 ChatGPT 或其他 AI 之前,先遮盖手机号、邮箱、身份证号、银行卡号、IBAN、IP 地址和 API 密钥。

浏览器本地运行AI 开发工具1.1万
免费

输入

0 B

结果

结果会显示在这里。

工单、日志和客户邮件正是人们最常粘贴给 AI 助手的文本,而它们满是个人信息。这个工具会找出文本里的各类标识信息,在文本离开你的电脑之前把它们替换掉。它沿用了 Presidio(data-privacy-stack/presidio,MIT,起源于微软的开源 PII 框架)的思路,并精简到浏览器在没有语言模型的情况下能可靠做到的程度:每类信息一个匹配规则,再加一个排除“长得像”的校验器——银行卡号用 Luhn 校验,身份证号用 GB 11643 校验位加真实出生日期,IBAN 用 mod-97 校验。

它是怎么工作的

  • 可识别:邮箱地址;中国大陆手机号和带区号的固定电话;以 + 或 00 开头的国际号码;(415) 555-2671 格式的北美号码;18 位居民身份证号;银行卡号;IBAN;IPv4 和 IPv6 地址;以及 OpenAI、Anthropic、AWS、GitHub、GitLab、Slack、Google、Hugging Face 的 API 密钥、JWT 和 PEM 私钥。
  • 编号标签(如 [PHONE_1])让同一个值每次都得到同一个标签,模型仍然能分清两个客户;星号保留大家熟悉的样子,比如 138****8000;假数据看起来像真的,但取自永远不可能属于任何人的号段。
  • 发现清单会列出每一项所在的行、类型、遮盖后的值和替换结果,任何时候都不会完整显示原值。
  • 全部处理都在浏览器里完成;由于处理的是敏感文本,即使是登录会员,本站也不会保留任何记录。

你的数据去了哪里

哪也没去。本工具完全在你的浏览器里运行:你粘贴的文本由页面处理,不会传输到任何服务器,也不会写进任何日志。

本工具会接触密钥和凭证,因此任何一次运行都不会被保存,连你自己的历史里也不会有。

它要花多少

本工具完全免费,不需要登录,也不消耗积分。

常见问题

能识别姓名和详细地址吗?
不能。要可靠地识别姓名和地址,需要专门训练过的语言模型,靠规则去猜会漏掉很多,还会误伤普通词语。发送前请通读脱敏后的文本,手动替换姓名;用编号标签的写法很容易保持一致,比如 [NAME_1]。
为什么有个号码没被识别出来?
每一项都必须通过校验:校验位不对的卡号、出生日期不存在的身份证号、mod-97 不通过的 IBAN 会被有意放过——它们不是真实的标识。没有国家代码也没有括号的纯 10 位数字同样会被跳过,因为订单号和时间戳长得一模一样。
假数据是怎么来的?
都取自专门留作测试或按规则不可能存在的范围:user1@example.com;以 100 开头的手机号;美国虚构号段 555-01xx;地区码为不存在的 000000、校验位正确的身份证号;支付机构公开的测试卡号;以及文档专用 IP 段 192.0.2.0/24 和 2001:db8::/32。
能把原始值换回 AI 的回答里吗?
用编号标签时可以手动完成:保留发现清单,把回答里的 [EMAIL_1] 等标签替换回去。清单里只显示遮盖后的值,所以请以你自己保留的原文作为对照依据。

背后的开源项目

本工具是独立实现,并未打包第三方库。data-privacy-stack/presidio(MIT)在代码层面做的是同一件事——如果你需要在自己的程序里实现它,从那里开始,而不是调用一个网页。

data-privacy-stack/presidio

也常被称作

  • 数据脱敏工具
  • 个人信息脱敏
  • 手机号脱敏
  • 身份证号脱敏
  • 敏感信息屏蔽
  • pii redaction