不用云端 OCR,从扫描 PDF 提取可编辑文字
- 选择一个扫描 PDF,或本地 PNG、JPEG、WebP 图片,再勾选需要识别的页面。
- 选择英语、简体中文或繁体中文;先旋转歪斜页面,并按需要裁剪、调整对比度。
- 执行识别,对照原图修正文字,最后导出 TXT 或 Markdown。
对照扫描件检查名称和数字
例如扫描订单中出现“Order 2048”,复制前应核对识别出的数字和标点。只需要文档开头时,选择第 1–3 页即可,不必处理整份文件。
表格、手写字和浅色字符可能识别错误。首次使用会下载 OCR 引擎及语言资源,但文档在本地处理;需要保留 PDF 并增加检索层时,请使用可搜索 PDF 工具。
