Text aus PDF extrahieren

Text ausgewählter PDF-Seiten extrahieren, prüfen und als UTF-8-TXT herunterladen. Gescannte Bilder werden nicht per OCR erkannt.

Kostenlos · Ohne Anmeldung · Kein Datei-Upload

Dateien hier ablegen

Unterstützte Dateien: PDF · Eine Datei, bis zu 100 MB

Bearbeitungsoptionen→ TXT

Beispiel: 1,3-5. Leer lassen für alle Seiten.

Die Textebene eines PDF auslesen

  1. Wählen Sie ein PDF mit auswählbarem Text aus.

  2. Prüfen Sie den extrahierten Text in der Vorschau.

  3. Laden Sie die TXT-Datei herunter.

Die gespeicherte Textebene entscheidet

Wird ein PDF zu reinem Text, entfallen Schriften, Bilder und Layout. Übrig bleiben nur die Wörter, die sich leicht in einen anderen Editor übernehmen lassen.

Spalten, Tabellen, besondere Schriften oder fehlende Zeichenzuordnungen können die Lesereihenfolge verändern. Leere oder gescannte Teilseiten werden mit einem Hinweis gemeldet.

Unterstützte Dateien

PDF → TXT

  • Eine Datei, bis zu 100 MB
  • Gesamteingabe: 300 MB
  • Gesamtausgabe: 150 MB
  • Seiten: ≤ 200

Verschlüsselte PDFs werden nicht unterstützt. Bestehender Text wird nicht bearbeitet; es erfolgt keine OCR.

Ergebnisbeispiel

Original

Ergebnisbeispiel: Text aus PDF extrahieren (Original)
journal-cover.pdf344.0 KB · 1 Seiten

Ergebnis

COASTAL NOTES THE SLOW ISSUE
BLURME / SAMPLE JOURNAL
A little closer
to the coast.
Light, texture and the pleasure of taking your time.
A table for two. A view for miles.
An imaginary travel journal, made for trying out your next edit.

Häufige Fragen

Warum liefert ein gescanntes PDF keinen Text?
Ein Scan kann nur Bilder von Buchstaben enthalten. Dieses Werkzeug liest die vorhandene Textebene und erkennt keine Schrift in Bildern.
Rekonstruiert die PDF-Textextraktion eine Tabelle?
Nein. Die Ausgabe ist Klartext; Zellen, Spalten und Layout werden nicht wiederhergestellt.
Bleiben koreanische, japanische und arabische PDF-Zeichen erhalten?
UTF-8 unterstützt sie, die Extraktion hängt aber von den Zeichenzuordnungen des PDF ab. Prüfen Sie fehlende oder vertauschte Zeichen.
Kann PDF-Text in anderer Seitenfolge exportiert werden?
Ja. 3,1-2 verarbeitet zuerst Seite drei, dann eins und zwei. Die Reihenfolge innerhalb einer Seite wird dadurch nicht geändert.
Werden meine Dateien auf einen Server hochgeladen?
Nein. Die Dateien werden im Browser auf diesem Gerät verarbeitet und nicht an BlurMe-Server gesendet.

Ähnliche Werkzeuge

Alle Werkzeuge

Mit BlurMe können Sie personenbezogene Daten in Dokumenten prüfen und schwärzen.

Zum Herunterladen ist ein kostenloses Konto nötig. Kostenlose Exporte enthalten ein Wasserzeichen.