PDF consultable depuis un scan
Choisissez un PDF scanné ou une image, indiquez la langue du document et téléchargez un PDF dont le texte se cherche, se sélectionne et se copie.
Le moteur OCR et les données linguistiques (environ 15 Mo) sont téléchargés depuis un CDN au premier lancement. Votre fichier ne quitte pas le navigateur.
Choisissez un PDF scanné ou une image.
À propos de cet outil
Un scan n’est qu’une image : Ctrl+F n’y trouve rien. L’OCR reconnaît les mots et les inscrit dans le PDF sous forme de couche de texte invisible placée exactement sur l’image : la page ressemble toujours au scan, mais la recherche, la sélection et la copie fonctionnent, tout comme l’indexation par les systèmes de gestion documentaire.
La reconnaissance utilise Tesseract compilé en WebAssembly et s’exécute entièrement sur votre appareil. Le moteur et le modèle de langue — environ 15 Mo — sont téléchargés depuis un CDN la première fois puis mis en cache par le navigateur ; votre document n’est jamais envoyé. Jusqu’à 30 pages sont traitées par exécution, et la précision dépend de la qualité du scan : 300 ppp et des pages droites donnent les meilleurs résultats.
Questions fréquentes
- Les pages garderont-elles le même aspect ?
- Oui. L’image est conservée et le texte reconnu est placé par-dessus de façon invisible : c’est le principe des PDF consultables.
- Quelle est la précision ?
- Bonne sur des scans nets de texte imprimé à 300 ppp, moindre sur des photos, des pages de travers, de l’écriture manuscrite ou des fonds très texturés.
- Mon document est-il envoyé ?
- Non. Seuls le moteur OCR et les données linguistiques sont téléchargés ; le fichier est traité dans votre navigateur.