PDFからテキスト
最大5件のPDFからテキストをプレーンな.txtファイルとして取り出します。
1 · ファイルを選ぶ
ここにPDFをドラッグ&ドロップ、またはクリックして選択
最大5件、1件あたり最大50MB
抽出ツールはPDFのテキストレイヤーを読み取ります。テキストレイヤーのないスキャンPDF(ページの写真)からはほとんど何も取り出せません。このツールはOCRを行いません。
すべての処理はオープンソースのPDFライブラリを使ってお使いの端末上で行われ、何もアップロードされません。
3 · ファイルを受け取る
結果はここに表示されます。1件ずつ、またはまとめてZIPでダウンロードできます。
PDFからテキストをオンラインで抽出する方法
- 最大5件のPDFを上のボックスに追加します。
- 「テキストを抽出」をクリックします。
- PDFごとに1つの.txtファイルを、またはまとめてZIPでダウンロードします。
よくある質問
テキストが選択できないPDFから文字をコピーするには?
PDFにテキストレイヤーがあれば、このツールで一度にすべて抽出できます。ページごとに選択するより簡単なことが多いです。何も出てこない場合、そのPDFはスキャンであり、OCRが必要です。
PDFからテキストが出てこないのはなぜですか?
ほぼ間違いなくスキャンされた文書です。ページがテキストレイヤーのない画像になっています。スキャンからのテキスト抽出にはOCRが必要ですが、このツールはOCRを行いません。
レイアウトは抽出後も残りますか?
プレーンテキストは読み順と改行を保ちますが、フォント、段組み、表は残りません。他のツールへの入力、検索、翻訳に使うのに最適です。
抽出はプライベートですか?
はい。テキストの読み取りは完全にブラウザ内で行われます。文書がサーバーにアップロードされることはありません。