Dokumente & PDF
PDF zu Text
Konvertierungsbereich
PDF zu Text
Extrahieren Sie den Text eines PDF-Dokuments Seite für Seite in der richtigen Reihenfolge in eine einzige TXT-Datei.
So funktioniert es
PDF auswählen
Wählen Sie eine PDF-Datei mit bis zu 50 MiB, die Text enthält.
Extraktion starten
Sobald die Dateiprüfung abgeschlossen ist, starten Sie die Textextraktion.
TXT speichern
Laden Sie die fertige TXT-Datei herunter.
Häufig gestellte Fragen
Kann ich Text aus einem gescannten PDF extrahieren?
Nein. Gescannte PDFs enthalten nur Bilder der Seiten, sodass keine Textebene zum Extrahieren vorhanden ist. Optische Zeichenerkennung (OCR) wird nicht unterstützt.
Warum weichen die Zeilenumbrüche vom Original ab?
Ein PDF speichert nur die Position jedes Zeichens, nicht die Absatzstruktur. Die Zeilen werden aus diesen Positionsdaten rekonstruiert, sodass Tabellen und mehrspaltige Layouts mit anderer Reihenfolge und anderen Umbrüchen herauskommen können.
Wie werden mehrere Seiten gespeichert?
Der Text aller Seiten wird in Seitenreihenfolge zusammengefügt und als eine einzige TXT-Datei gespeichert.
Werden nicht-englische PDFs unterstützt?
Ja. Der extrahierte Text wird als UTF-8 gespeichert, das die meisten Sprachen unterstützt, darunter auch Koreanisch. Manche Spezialschriften werden allerdings unter Umständen nicht korrekt extrahiert.
Wird mein PDF irgendwohin gesendet?
Nein. Ihre Datei verlässt Ihr Gerät nicht. Die Extraktion läuft vollständig in Ihrem Browser, und es wird nichts hochgeladen.