PDFからテキストを抽出
PDFの文字を、検索・貼り付け・他のツールへの受け渡しに使えるプレーンテキストファイルとして取り出します。書式も画像もなく、読み順に並んだテキストだけです。
1 · ファイルを選ぶ
ここにPDFをドラッグ&ドロップ、またはクリックして選択
最大5件、1件あたり最大50MB
抽出ツールはPDFのテキストレイヤーを読み取ります。テキストレイヤーのないスキャンPDF(ページの写真)からはほとんど何も取り出せません。このツールはOCRを行いません。
すべての処理はオープンソースのPDFライブラリを使ってお使いの端末上で行われ、何もアップロードされません。
3 · ファイルを受け取る
結果はここに表示されます。1件ずつ、またはまとめてZIPでダウンロードできます。
PDFからテキストを抽出する手順
- 上のボックスにファイルをドロップするか、クリックして選択します。
- このページの設定はすでに選ばれています。別の結果が欲しいときは変更してください。
- ボタンを押します。すべてブラウザ内で行われるため、何もアップロードされません。
- 結果をダウンロードするか、複数のファイルをまとめてZIPで受け取ります。
よくある質問
スキャンされた文書でも使えますか?
スキャン時に作られたテキストレイヤーがすでに入っている場合だけです。ページをただ撮っただけの写真には取り出せるテキストがなく、このツールはピクセルから文字を読み取りません。結果が空で返ってきたときは、それが理由です。
ファイルの何かが変わりますか?
変わるのは指定したことだけです。テキストはテキストのままで選択でき、ページのサイズも保たれ、画像に統合されることもありません。唯一の例外は圧縮で、こちらはファイルを変えるためのものであり、その旨も明記されています。
何かアップロードされますか?
いいえ。PDFエンジンはブラウザ内で動くため、ファイルはお使いの端末上で読み込まれ、端末から出ることはありません。アカウントも、順番待ちも、アップロードもありません。
本当に無料ですか?
はい。登録も試用期間も透かしもなく、処理できるファイル数にも上限はありません。サイトは広告で運営されています。