Zum Inhalt springen
iyziTool

Durchsuchbares PDF aus einem Scan

Wählen Sie ein gescanntes PDF oder ein Bild, geben Sie die Dokumentsprache an und laden Sie ein PDF, dessen Text sich suchen, markieren und kopieren lässt.

OCR-Engine und Sprachdaten (etwa 15 MB) werden beim ersten Lauf von einem CDN geladen. Ihre Datei verlässt den Browser nicht.

Wählen Sie ein gescanntes PDF oder ein Bild.

Über dieses Tool

Ein Scan ist nur ein Bild, deshalb findet Strg+F darin nichts. OCR erkennt die Wörter und schreibt sie als unsichtbare Textebene exakt über das Bild ins PDF: Die Seite sieht weiterhin aus wie der Scan, aber Suche, Markierung und Kopieren funktionieren — ebenso die Indexierung durch Dokumentenmanagementsysteme.

Die Erkennung läuft mit Tesseract als WebAssembly vollständig auf Ihrem Gerät. Engine und Sprachmodell — rund 15 MB — werden beim ersten Mal von einem CDN geladen und danach vom Browser zwischengespeichert; Ihr Dokument wird nirgendwohin gesendet. Pro Durchlauf werden bis zu 30 Seiten verarbeitet, und die Genauigkeit hängt von der Scanqualität ab: 300 dpi und gerade Seiten liefern die besten Ergebnisse.

Häufige Fragen

Sehen die Seiten danach gleich aus?
Ja. Das Bild bleibt erhalten, der erkannte Text liegt unsichtbar darüber — so funktionieren durchsuchbare PDFs überall.
Wie genau ist die Erkennung?
Gut bei sauberen 300-dpi-Scans von Drucktext, schlechter bei Fotos, schiefen Seiten, Handschrift oder starken Hintergrundmustern.
Wird mein Dokument hochgeladen?
Nein. Geladen werden nur OCR-Engine und Sprachdaten; die Datei wird im Browser verarbeitet.

Ähnliche Tools