PDF工具

PDF 文本脱敏遮盖工具

在线查找 PDF 文档中的指定文本并应用遮盖涂黑,支持设置 ASCII 替换字符,直接生成处理后的 PDF 文件。

运行工具

本工具专为检索并遮盖 PDF 文档中的敏感文本内容而设计。当您上传包含有效 PDF 结构的 Base64 编码文档并输入目标关键词时,工具会自动遍历文档各页的可检索文本图层,精确定位所有匹配字段的位置坐标,并对对应区域应用脱敏遮蔽。在输出的文档中,原始文字图层的内容将被彻底抹除并替换,同时界面会清晰展示处理完成的总页数以及匹配遮盖的发生次数统计。在配置选项中,您可以根据排版需要自定义用于覆盖的 ASCII 替换字符串;若保留默认设置,系统将直接生成实心矩形色块完成遮挡。此功能适用于合同脱敏、财务单据信息保护以及对外发布报告前的合规处理。需要说明的是,本工具主要面向包含可选文字图层的矢量 PDF 文件,无法对扫描件或纯图片内容执行光学字符识别分析。

使用说明

  1. 在“PDF 文件”区域上传或填入经过 Base64 编码的 PDF 文档数据。
  2. 在“待遮盖文本”输入框中输入需要检索并移除的具体关键词或字符内容。
  3. 根据需要在“替换字符”中输入用于替换的 ASCII 文本(默认为遮盖色块)。
  4. 点击运行按钮,系统将执行脱敏检索并生成处理后的文档及统计信息。

示例

  • 遮盖合同中的身份证号:上传 Base64 编码的 PDF 合同文档,在待遮盖文本中输入指定的 18 位身份证号码,保留默认替换色块,执行后获得敏感号码已被涂黑遮盖的新 PDF 文件。
  • 替换报告中的内部代号:上传 PDF 格式的调研报告,在待遮盖文本中填入代号“Project-Alpha”,在替换字符中输入“[REDACTED]”,执行后原代号位置将被替换文字覆盖。

常见问题

工具能否遮盖扫描版 PDF 或图片中的文字?

不能。该工具仅检索并处理 PDF 文档内的可选文本图层,不支持对纯图片或扫描件执行光学字符识别(OCR)脱敏。

为什么非 ASCII 字符无法作为替换文字显示?

底层遮盖机制仅支持传入 ASCII 格式的替换文本。如果输入非 ASCII 字符,系统将不会将其作为替换文字写入,而是直接执行默认区域遮盖。

待遮盖文本输入框可以留空吗?

不可以。待遮盖文本为必填项,如果不填写任何字符,操作将在解析文件前提示终止。

处理完成后如何确认哪些内容被遮盖了?

界面会明确反馈已处理的页面总数以及匹配并执行遮盖的具体次数,同时提供脱敏后的 PDF 供下载查验。

嵌入此工具

使用以下代码,将这个可直接使用的 SmartPlusLab 工具添加到您的网站。