Zum Inhalt springen
iyziTool

PDF in Text umwandeln

Wählen Sie ein PDF, und sein Text erscheint Seite für Seite, bereit zum Kopieren oder Speichern als Textdatei. Gescannte Dokumente ohne Textebene werden erkannt und gemeldet.

Text
Wählen Sie ein PDF, um seinen Text zu extrahieren.

Über dieses Tool

Die meisten von Textverarbeitungen, Browsern und Exportwerkzeugen erzeugten PDFs enthalten eine Textebene: Die Zeichen sind zusammen mit ihrer Position auf der Seite gespeichert. Dieser Konverter liest diese Ebene mit der pdf.js-Engine, setzt die Zeilen in Lesereihenfolge zusammen und gibt reinen Text aus, den Sie zum Suchen, Zitieren, Übersetzen oder für andere Software brauchen.

Das Layout wird abgeflacht: Spalten, Tabellen und Fußnoten erscheinen als aufeinanderfolgende Zeilen, denn eine Textdatei kennt keine Kästen. Gescannte PDFs sind nur Bilder von Seiten; sie enthalten keine Textebene und bräuchten OCR, das dieses Werkzeug nicht durchführt. Die Verarbeitung findet vollständig im Browser statt.

Häufige Fragen

Warum ist die Ausgabe leer?
Das PDF ist wahrscheinlich ein Scan, es gibt also keinen Text zu extrahieren. Eine OCR-Software müsste die Zeichen in den Bildern erkennen.
Bleiben Tabellen erhalten?
Die Zellinhalte bleiben in Lesereihenfolge, das Raster nicht. Kopieren Sie den Text für Tabellenkalkulationen und trennen Sie ihn anschließend nach Spalten.
Kommt es mit großen Dateien zurecht?
Ja. Die Seiten werden einzeln verarbeitet, und ein Zähler zeigt den Fortschritt. Sehr große Dateien brauchen einige Sekunden.
Wird das Dokument hochgeladen?
Nein. Die Textextraktion läuft vollständig auf Ihrem Gerät.

Ähnliche Tools