文書・PDF
PDF→テキスト変換
PDF文書に含まれるテキストをページ順に抽出し、1つのTXTファイルにまとめます。
変換ワークスペース
PDF→テキスト変換
PDF文書に含まれるテキストをページ順に抽出し、1つのTXTファイルにまとめます。
ブラウザの対応状況を確認中
開始前に、ファイル選択とダウンロード機能への対応を確認しています。
使い方
PDFを選ぶ
テキストを含む最大50 MiBのPDFファイルを選択します。
抽出を開始する
ファイルの確認が完了したら、テキストの抽出を開始します。
TXTを保存する
完成したTXTファイルをダウンロードします。
よくある質問
スキャンしたPDFからテキストを抽出できますか?
いいえ。スキャンPDFにはページの画像しかなく、抽出できるテキストレイヤーがありません。光学文字認識(OCR)には対応していません。
改行が元と異なるのはなぜですか?
PDFは段落構造ではなく、各文字の位置だけを保存します。その位置情報から行を組み直すため、表や段組みでは順序や改行が元と異なる場合があります。
複数ページはどのように保存されますか?
すべてのページのテキストがページ順に連結され、1つのTXTファイルとして保存されます。
日本語以外のPDFにも対応していますか?
はい。抽出されたテキストはUTF-8で保存されるため、日本語や韓国語を含むほとんどの言語に対応しています。ただし、一部の特殊なフォントは正しく抽出できない場合があります。
PDFはどこかに送信されますか?
いいえ。ファイルがお使いの端末の外に出ることはありません。抽出はすべてブラウザ内で実行され、何もアップロードされません。