Zum Inhalt springen

PDF in Text

Wähle eine PDF, extrahiere auswählbaren Text und erkenne gescannte Seiten bei Bedarf mit lokaler OCR, bevor du das Ergebnis kopierst oder als TXT-Datei herunterlädst.

PDF auswählen

Ziehe eine PDF hierher oder wähle sie aus. Textextraktion und optionale OCR laufen lokal im Browser.

Leer lassen für alle Seiten. Seiten und Bereiche mit Kommas trennen.

Text extrahieren

Liest zuerst vorhandenen PDF-Text und führt dann optional nur auf ausgewählten Seiten ohne extrahierbaren Text OCR aus.

PDF in Text

Schnellstart

1
PDF auswählen
2
Bei Bedarf Seiten festlegen
3
Text extrahieren und Scans bei Bedarf per OCR erkennen
4
Kopieren oder TXT herunterladen

Häufige Anwendungsfälle

Kopieren

Übertrage auswählbaren oder gescannten Text aus einer PDF in Notizen, E-Mails oder einen anderen Editor.

Gezielte Extraktion

Lies oder erkenne per OCR nur die benötigten Seiten einer langen PDF.

Archivieren

Speichere eine schlanke TXT-Kopie einer lokalen PDF, ohne die Datei hochzuladen.

Eingabe & Ausgabe

Eingabe: eine lokale PDF mit auswählbarem Text, gescannten Seiten oder beidem.
Seiten: standardmäßig alle Seiten oder ein Bereich wie 1-3,5.
Ausgabe: reiner Text zum Kopieren oder Herunterladen als TXT-Datei.

Nutzungstipps

Lass OCR für auswählbaren PDF-Text deaktiviert. Aktiviere es, wenn die ausgewählten Seiten Scans oder Bilder sind.
Extrahiere bei langen oder ungewöhnlichen PDFs zuerst einen kleinen Seitenbereich.
Sehr große PDFs können Zeit benötigen und Speicher- oder Textlimits des Browsers erreichen.

Einschränkungen und Kompatibilität

OCR ist optional und läuft nur auf ausgewählten Seiten ohne extrahierbaren Text. Handschrift, niedrig aufgelöste Scans und komplexe Layouts können die Genauigkeit beeinträchtigen.
Die Ausgabe als reiner Text bewahrt keine komplexen PDF-Layouts, Spalten, Tabellen, Schriftarten oder Anmerkungen.
Passwortgeschützte oder ungewöhnliche PDFs können fehlschlagen, wenn PDF.js oder der Browser sie nicht dekodieren kann.

Datenschutz & Sicherheit

Die Verarbeitung läuft im Browser. CrateX.app lädt weder die PDF noch den extrahierten Text hoch. Wenn OCR aktiviert ist, werden Sprachressourcen für die lokale Erkennung heruntergeladen; PDF und Ergebnisse bleiben im Seitenspeicher und werden standardmäßig nicht synchronisiert.

Häufige Fragen

9

Fahren Sie mit diesen verwandten Tools im nächsten Schritt fort.

Die gesamte Verarbeitung der Tools findet lokal in Ihrem Browser statt.