Aller au contenu
iyziTool

Convertisseur PDF en texte

Choisissez un PDF : son texte apparaît page par page, prêt à copier ou à enregistrer en texte brut. Les documents numérisés sans couche de texte sont détectés et signalés.

Texte
Choisissez un PDF pour en extraire le texte.

À propos de cet outil

La plupart des PDF produits par les traitements de texte, les navigateurs et les outils d'export contiennent une couche de texte : les caractères sont stockés avec leur position sur la page. Ce convertisseur lit cette couche avec le moteur pdf.js, réassemble les lignes dans l'ordre de lecture et produit du texte brut, ce qu'il faut pour rechercher, citer, traduire ou alimenter d'autres logiciels.

La mise en page est aplatie : colonnes, tableaux et notes de bas de page ressortent en lignes consécutives, puisqu'un fichier texte n'a pas de cases. Les PDF numérisés ne sont que des images de pages ; ils ne contiennent aucune couche de texte et nécessiteraient une reconnaissance optique (OCR), que cet outil ne fait pas. Le traitement a lieu entièrement dans votre navigateur.

Questions fréquentes

Pourquoi le résultat est-il vide ?
Le PDF est probablement une numérisation, il n'y a donc pas de texte à extraire. Un logiciel d'OCR serait nécessaire pour reconnaître les caractères dans les images.
Les tableaux sont-ils conservés ?
Le contenu des cellules est gardé dans l'ordre de lecture, mais pas la grille. Pour les tableurs, copiez le texte et découpez-le ensuite par colonnes.
Gère-t-il les gros fichiers ?
Oui. Les pages sont traitées une par une et un compteur montre la progression. Les très gros fichiers prennent quelques secondes.
Le document est-il envoyé ?
Non. L'extraction du texte s'exécute entièrement sur votre appareil.

Outils similaires