本机运行 · 免费

PDF 涂黑脱敏

涂黑等于消失,不是盖住

和 Acrobat Standard 的详细对比

  1. 1

    打开文档

    最多 50 页。文件从磁盘读出来,不会被送到任何地方。对这件事来说这就是全部重点:一份值得脱敏的文档,本来就不该先交给一个陌生人。

  2. 2

    标出要去掉的部分

    在不该留下的地方拖一个框。或者按那个按钮,让一个阅读器先把每一页读一遍,在文字里找出人名、住址、电话、账号、日期和密码,替你框好。两种方式下留什么都由你决定:任何一个框点一下就去掉。

  3. 3

    保存

    出来的每一页都是图片,这正是删除之所以不可逆的原因。文件里不再有文字层,被盖住的字也就没有地方可以幸存。

FAQ

为什么画一个黑方块不够?
因为在 PDF 里,那个方块和那段文字是两样东西,只是叠在一起。字还在文件里,还能选中,任何用读的方式而不是用看的方式打开这份文档的东西都还拿得到。现实中就是这样泄漏的,而发布文件的人都以为自己已经脱敏了。框选那块区域按一下复制,就够了。
那这个工具是怎么做的?
它把每一页画成像素,把方块涂在像素上,再用这些图片重新组成一份文档。结果里根本没有文字层,被盖住的字也就无处可藏。这一点你可以自己验证,不用信我们:打开你保存下来的文件,试着去选中其中一行。
代价是什么?
这份文档从此不能被搜索、选中或复制,任何人都不能,包括你自己。体积也会变大,因为一页的图片比一页的文字重。把原件留好,把脱敏后的这份当成交出去的那一份。
我的文档会被上传吗?
不会。每一页的绘制、标记和重建都在这个页面里、在你自己的机器上完成,没有任何请求把文档带到别处。这是全站最看重这一点的工具,它之所以是现在这个做法,原因也在这里。
自动识别靠谱吗?
它能找到正则找不到的那些。它是照人快速扫一眼的方式读文字的,所以它认出一个人名是因为旁边那些词,认出一个住址是因为那看起来像个能寄信的地方。在一行同时包含人名、街道、邮箱、电话、卡号、日期和 API key 的文字上,七个它全部框住了。但它不保证任何事:它也把一个纯粹是公司内部的参考编号框了进去。每一页都要自己读,包括它一个框都没标的那些。
为什么查找是一个单独的按钮?
因为它要下载 875 MB,运行时还要一个 G 左右的内存,而没有人应该为了打开一份文档付这个代价。手动标不需要这些,涂黑的不可逆程度两种方式完全一样。只有你想让它替你读的时候才按,而且第一次之后浏览器会把它保存下来。
为什么说自动查找需要桌面端?
因为手机不会给浏览器标签页一个 G 的内存。结果会是整个下载完之后被系统杀掉,那比一开始就告诉你更难受。这个工具的其余部分在手机上照常可用。
为什么涂黑的范围比我想要的大?
因为它盖的是匹配所在的一整段文字。PDF 只报告一段文字有多宽,不报告其中每个字母有多宽,所以精确切到匹配的那几个字符只能靠估算,而估算少了一点,卡号的最后一位就露在外面。多盖几个字是更安全的那种错。想要更紧的话,把这个框去掉自己画一个。

更多同类工具