保留扫描页面,同时为 PDF 添加文字搜索层
- 打开扫描件,选择需要处理的页面及 OCR 语言。
- 执行识别并检查文字;结果有误时,改善扫描质量或设置后重新识别,再生成 PDF。文字预览为只读,不能直接修改。
- 在 PDF 阅读器中打开导出文件,搜索已处理页面中的一个特定词语或号码。
导出后实际测试一次搜索
如果扫描收据中有“2048”,在导出的 PDF 中搜索 2048,并核对高亮位置是否对应原图。能够看到页面图片,并不能证明文字搜索层已经正确生成。
文字层用于查找和选择内容,不会移除隐私信息。OCR 可能错识或错位,重要姓名和金额需要复核;分享包含敏感区域的文件前,应使用脱敏工具处理。
