敏感信息脱敏工具
粘贴包含身份证号、手机号、银行卡号、邮箱、姓名、地址或自定义关键词的文本,一键替换为等长星号。识别在一次扫描内完成,避免同一号码被重复打码;全部处理在浏览器内进行,适合给截图、工单、日志、聊天记录做脱敏。
把带个人信息的文本发到群里、贴进工单或截进教程图之前,先用它把身份证号、手机号、银行卡号、邮箱打上码。打码采用等长替换:星号占的位数与原文一致,方便逐字核对码的是哪一段,也不会额外暴露长度之外的信息。
两个容易记错的点:一是脱敏不可逆,星号替换没有对照表,确认不再需要原文后再操作;二是纯正则认不出没有姓名、地址标签的人名和地址,这类内容要填进自定义关键词精确处理。它降低的是泄露风险,不能替代数据合规流程。
这个工具解决你的问题了吗?
提交后会把工具名、你的输入与当前结果发送到服务器;请勿填写身份证号、手机号等隐私信息。
AI 助手 会结合你当前的输入与结果回答
追问会再次把当前输入与结果发送到服务器;请勿填写隐私信息。
使用步骤
- 把含敏感信息的文本整段粘进输入框,识别与统计即时完成。
- 核对识别清单:身份证、手机号、银行卡、邮箱各命中几处,确认没有漏网内容。
- 正则认不出的内容(客户名、项目代号、无标签地址)填进自定义关键词,优先替换。
- 确认无误后复制结果,原文留在本页内存里,刷新即消失。
计算原理与示例
识别哪些内容
自动识别六类内容:身份证(18 位含末位 X,以及 15 位旧号)、手机号(1 开头共 11 位)、银行卡(15-19 位数字,62 开头的 18 位按银联卡处理)、邮箱,以及「姓名:」「联系人:」「地址:」这类带标签的姓名与地址。
掩码规则
打码一律等长替换:身份证保留前 6 位与后 4 位,手机号保留前 3 后 4,银行卡保留前 4 后 4,邮箱保留前 2 位与完整域名,姓名保留姓氏(张*、欧**),地址保留到省市区县。长度不变,既方便与原文逐字对照,也不会额外泄露位数之外的信息。
自定义关键词优先
自定义关键词优先级最高、先替换,适合标记客户名、项目代号等正则识别不到的内容;如果关键词里含数字(比如内部工单号),也会先被替换掉,不会再被后面的自动规则重复处理。
代码示例
JavaScript 用正则给手机号与身份证打码
// 与本工具同口径:等长替换,保留前 3 后 4 / 前 6 后 4
const mask = (s) => s
.replace(/(1[3-9]\d)\d{4}(\d{4})/g, "$1****$2") // 手机号
.replace(/(\d{6})\d{8}(\d{3}[\dXx])/g, "$1********$2"); // 18 位身份证
mask("联系 13812345678,证件 110101199003078515X");
// "联系 138****5678,证件 110101********8515X"
Shell 先找出日志里的敏感信息再打码
# 先看日志里有哪些手机号(决定打码范围)
grep -oE "1[3-9][0-9]{9}" app.log | sort -u
# 打码:保留前 3 后 4
sed -E "s/(1[3-9][0-9])[0-9]{4}([0-9]{4})/\1****\2/g" app.log > app-masked.log
# 提示:sed 处理身份证要区分 15/18 位两种长度,建议先 grep 确认格式
常见问题
脱敏后的文本还能还原吗?
不能。星号替换是不可逆的,处理过程不生成原文与掩码的对照表,也不保留原文副本。如果需要「可还原的遮蔽」,那属于加密而不是脱敏,需要自己保管密钥。
为什么中文姓名只脱敏「姓名:张三」这种写法?
中文姓名没有固定格式,两个到四个汉字都可能成词,纯正则判断会把正文里的普通词误判成人名。因此只对带标签的写法脱敏,准确率优先;正文里的人名可以填进「自定义关键词」精确处理。
地址脱敏为什么保留到区县?
保留到区县既能让原文保持可对照(方便确认是哪位客户或哪条记录),又去掉了路名、门牌、单元等可定位到具体住所的信息。如果连区县也不能出现,可以把它作为自定义关键词整体替换。
15 位身份证和 16 位银行卡会不会认错?
两者位数不同,不会冲突。真正需要区分的是 18 位纯数字——它既可能是身份证也可能是银联卡,本工具以是否 62 开头判断:62 开头按银行卡(保留前 4 后 4),其余按身份证(保留前 6 后 4)。两者都会完整打码,不影响安全性。
自定义关键词和自动识别谁的优先级高?
自定义关键词先执行。被关键词覆盖的内容不会再进入自动识别,因此统计里只计为「自定义」,不会重复计数;反过来,如果关键词是「13800138000」这种号码,它也不会再被算作手机号。
脱敏能代替数据合规处理吗?
不能。脱敏只是降低泄露风险的技术手段,不能替代授权同意、最小必要收集、留存期限管理等合规要求。对外提供或公开发布数据前,建议再人工复核一遍,确认没有遗漏的间接标识(如订单号、设备号)。
为什么掩码长度和原文一样?
等长替换便于逐字核对,也不会改变文本的整体解析结构。如果你希望连长度都不暴露,可以把整段内容作为自定义关键词替换成固定长度的星号。
粘贴进来的文本会被上传或保存吗?
不会。识别与替换都在浏览器本地用正则完成,文本不经过服务器、不写访问日志,也不写入浏览器存储——因此本工具不提供计算历史,关闭或刷新页面后内容即消失,粘贴前请确认已完成复制。
延伸阅读
来自本站原创文章,讲清这个工具背后的算法与口径。