tool.ren

検索可能なPDF作成・OCR

スキャンされた PDF または画像をローカルで認識し、Unicode テキストのみの PDF レイヤーを通じて検索可能な英語と中国語を保存し、エクスポート前に抽出を検証します。

ドキュメント、ページ画像、OCR テキストはアップロードされません。最初の実行では、パブリック CDN から OCR エンジンと言語モデルのみがダウンロードされます。

検索可能なPDF作成・OCR

元のページを保持し、再読み取りによって検証された OCR テキスト レイヤーを追加します。スキャンされた PDF または画像をローカルで認識し、Unicode テキストのみの PDF レイヤーを通じて検索可能な英語と中国語を保存し、エクスポート前に抽出を検証します。

ページ画像を保ったまま、スキャンPDFに検索用テキストを追加する

  1. スキャン文書を開き、対象ページとOCR言語を選択します。
  2. OCRを実行して認識結果を確認します。誤認識がある場合は原稿や設定を改善してOCRをやり直してからPDFを作成します。文字プレビューは読み取り専用です。
  3. 出力したPDFをビューアーで開き、処理したページにある特徴的な単語や数字を検索します。

出力後に検索を試す

領収書に「2048」とある場合は、出力PDFで2048を検索し、強調表示の位置を領収書の画像と照合します。画像が見えるだけでは、検索用テキスト層が正しく追加されたとは確認できません。

テキスト層は文字の検索・選択用であり、個人情報を削除するものではありません。OCRは文字や位置を誤る場合があるため、重要な名前や金額を確認してください。機密情報を含む文書を共有する前には墨消しツールを使用してください。

主な機能

  • ドキュメントをラスタライズする代わりに、ソース PDF ページを表示したままにします
  • Unicode テキスト レイヤーに Tesseract テキストのみの PDF を使用する
  • 既存のテキストを検出し、OCR が必要なページを選択します
  • PDF.js でエクスポートを再度開いて、抽出可能なテキストを確認します

活用例

  • スキャンされたアーカイブを検索可能にする
  • スキャンした契約書、領収書、文書からテキストをコピー
  • ローカル ドキュメントのインデックス作成用に PDF とサイドカー テキストを作成する

よくある質問

検索可能なPDF作成・OCRでは何ができますか?

スキャンされた PDF または画像をローカルで認識し、Unicode テキストのみの PDF レイヤーを通じて検索可能な英語と中国語を保存し、エクスポート前に抽出を検証します。 主な機能:ドキュメントをラスタライズする代わりに、ソース PDF ページを表示したままにします、Unicode テキスト レイヤーに Tesseract テキストのみの PDF を使用する、既存のテキストを検出し、OCR が必要なページを選択します、PDF.js でエクスポートを再度開いて、抽出可能なテキストを確認します。

どのような場面で役立ちますか?

スキャンされたアーカイブを検索可能にする、スキャンした契約書、領収書、文書からテキストをコピー、ローカル ドキュメントのインデックス作成用に PDF とサイドカー テキストを作成するなどの用途に利用できます。操作前に、対応形式や入力条件をページ内で確認してください。

入力データはどこで処理されますか?

主要な処理は現在のブラウザ内で行う設計です。アカウント、コメント、匿名の利用状況の記録などでは通常のサイト通信が発生することがあります。機密情報を扱う前に、このツールの注意事項と対応形式・容量の制限を確認してください。

コメント

0 コメント

コメントするにはサインインしてください
アカウント

コメントしたり返信するにはサインインしてください。

ログイン
コメントはまだありません。最初にフィードバックを残してください。

ToolRen オンラインツール集 © 2026