PDF 隐私涂抹
自动找出手机号、身份证等敏感信息并涂黑;涂掉的文字彻底删除,不是盖个黑框。文件不上传。
点击选择或将 PDF 拖入此处
识别与涂抹全部在你的浏览器本地完成,文件不会上传
不确定它是不是真的没上传?断网试一次
这个页面是 PWA,首次打开后资源已经缓存在本地。你可以现在就开飞行模式或拔掉网线,再回来拖入文件——识别、涂抹、导出会照常完成。这是最直接的验证方式,不需要你相信任何承诺,也不需要看网络面板。
- 1先正常打开本页,等页面完全加载
- 2开飞行模式 / 断开 Wi-Fi
- 3拖入 PDF,照常涂抹并下载
唯一的例外:扫描件 OCR 首次使用需要下载约 8MB 识别模型,之后同样离线可用。
常见的三类场景
HR:背调材料、工资单
外发的背调报告与工资条里通常混着身份证号、银行卡号与手机号,而收件方只需要核对姓名与在职时间。自动识别会把这三类找出来,你逐条确认后一次涂掉;工资明细这类没有固定格式的数字,用手动框选补。
律师:卷宗、证据材料
提交对方或法庭的材料常需隐去当事人与第三人的身份信息,而这类文件多是扫描件。扫描页会自动走本地 OCR 定位文字位置——注意涂抹后该页会变成图片,若对方要求可检索文本,请另行说明。
财务:对账单、报销凭证
对账单外发给审计或业务方时,卡号与账号要隐去、金额与日期要保留。银行卡号走 Luhn 校验识别,误把发票号当卡号的情况会被挡掉;表格里相邻单元格的数字不会被连成一串误判。
为什么「画个黑框」不算脱敏
很多人用看图软件或 PDF 编辑器在敏感信息上画一个黑色方块就当作已经脱敏——这是本类操作最常见也最危险的误解。PDF 里的黑框只是一条叠加在上层的绘制指令,被盖住的文字对象仍然原封不动地留在文件的内容流里:用文本提取工具、直接复制粘贴、或者在编辑器里把黑框拖走,原文就会重新出现。真正的脱敏必须让那些字符从文件里消失。本工具的做法是把该页渲染成位图、在位图上填涂,再用位图重建整页——涂掉的文字在导出文件里物理不存在,与阅读器无关。
涂掉的文字是真的删除了
涂抹区域被烧进像素并整页重建,用 pdftotext 等工具也提取不到任何字符;代价是该页变成图片,属于必要取舍。
自动识别 + 手动补充
自动找出手机号、身份证号(校验位验证)、银行卡号(Luhn 校验)与邮箱;识别不到的可以自己在页面上拖动框选。
扫描件也能处理
没有文字层的扫描页会自动走本地 OCR 识别位置,模型与识别全部在你的浏览器里运行。
文件不上传
识别与涂抹全部在浏览器本地完成,敏感文件不会经过任何服务器——这类操作的对象本就最不该上传。