Convertidor de PDF a texto
Elige un PDF y su texto aparece página a página, listo para copiar o guardar como archivo de texto plano. Los documentos escaneados sin capa de texto se detectan y se señalan.
Sobre esta herramienta
La mayoría de PDF producidos por procesadores de texto, navegadores y herramientas de exportación contienen una capa de texto: los caracteres se almacenan junto con su posición en la página. Este convertidor lee esa capa con el motor pdf.js, recompone las líneas en orden de lectura y genera texto plano, que es lo que necesitas para buscar, citar, traducir o alimentar otros programas.
El diseño se aplana: columnas, tablas y notas al pie salen como líneas consecutivas, porque un archivo de texto no tiene cajas. Los PDF escaneados son solo imágenes de páginas; no contienen capa de texto y necesitarían OCR, que esta herramienta no realiza. El procesamiento ocurre por completo en tu navegador.
Preguntas frecuentes
- ¿Por qué la salida está vacía?
- El PDF probablemente es un escaneo, así que no hay texto que extraer. Haría falta un software de OCR para reconocer los caracteres de las imágenes.
- ¿Se conservan las tablas?
- El contenido de las celdas se mantiene en orden de lectura, pero no la cuadrícula. Para hojas de cálculo, copia el texto y sepáralo por columnas después.
- ¿Puede con archivos grandes?
- Sí. Las páginas se procesan de una en una y un contador muestra el progreso. Los archivos muy grandes tardan unos segundos.
- ¿Se sube el documento?
- No. La extracción de texto se ejecuta por completo en tu dispositivo.