ページごとにテキストを抽出してダウンロード可能なテキストファイルにします。テキスト層のないスキャンはほとんど抽出できません。
PDF からテキストを抽出する方法
- パネルに PDF を追加します。
- ボタンを押してテキストを抽出します。
- 各ページのテキストが入った .txt ファイルをダウンロードします。
こんなときに PDF をテキスト化する
テキスト抽出は PDF の言葉を別の形で使いたいときの最初の一歩です。引用を打ち直さずにコピーする、どのエディターでも検索できるようにする、他のツールに内容を渡す、といった用途があります。
出力は各ページのテキストが順番に並んだプレーンテキストで、どこにでも貼り付けられます。
ブラウザで抽出する理由
抽出はデバイス上でローカルに行われるため、文書はアップロードされません。契約書や下書きなど、サーバーに送りたくないテキストでも安心です。
登録不要で無料、どのブラウザでも使えます。iPhone の PDF Shrink アプリでも同じローカルツールをオフラインで利用できます。
よくある質問
スキャン PDF でも使えますか?
テキスト層がある場合のみ。画像のみのスキャンは抽出できず、先に OCR が必要です。
出力の形式は?
各ページのテキストが順番に並んだプレーンテキストの .txt ファイルです。
元のファイルは変更されますか?
いいえ。PDF は読み取りだけで、テキストは新しいファイルに書き出されます。
文書はアップロードされますか?
いいえ。すべてブラウザ内で処理されます。